DeepSeek-V4.1-Flash
552B MoE,prefill 激活 8B、decode 激活 16B。CED 编解码使 prefill 计算近似减半;CSA2 跨层 KV 共享叠加 FP4,把全局 KV 压到约 1/4、持久化 KV 压到约 1/8。在完整 model card 发布前,价格 / 规格字段沿用 V4-Flash 档估算。
01
快照
综合
76
27 款中第12
编码
89
27 款中第5
多模态
78
27 款中第16
输入 / 输出
$0.14 / $0.28
每百万 token 美元价
上下文
1M
可用记忆 98
速度
约 85 tok/s
首 token 0.3s
聚合自公开信息并独立加权,方法见 条款 页。3 分以内视为统计持平。
02
规格与价格
收录的每个字段。标价为每百万 token 的美元价;采购前请核对厂商实时定价。
| 厂商 | DeepSeek(中国大陆) |
| 发布 / 当前版本 | 2026.09 |
| 授权方式 | 开源权重 |
| 上下文窗口 | 1M |
| 最大输出 | 128K |
| 有效上下文得分 | 98 |
| 输入 / 输出价格 | $0.14 / $0.28 每百万 token |
| 缓存折扣 | 无公开缓存折扣 |
| 免费档 | DeepSeek App 免费;开源权重可自托管 |
| 速度 / 首 token | 约 85 tok/s / 0.3s |
| 函数调用 | 84 |
| 拒答率 | 约 5% |
| 英文 / 中文 | 84 / 86 |
| 模态 | text、image |
| 微调 | 是 |
| 私有化部署 | 是(企业) |
| SOC2 / 不训练 | 否 / 是 |
03
优势与注意点
优势
- 1M 上下文,全局 KV 约 890 字节/token
- 智能体编码顶尖(DeepSWE 74.2、Terminal-Bench 2.1 90.6)
- 有界重放把持久化 KV 压到约 1/8
- 开源权重,服务成本极低
注意点
- 最难科学智能体仍有差距(Terminal-Bench 4.0)
- 多模态不及顶级闭源模型
- 生态较新、较小
04
在 27 款模型中的排名
综合 76/100(第12),编码 89(第5),多模态 78(第16)。完整榜单与并排对比见 排行榜。
05
实际价格
示意月度账单,按 1 亿输入 + 3000 万输出 token:标价 $22。实际随你的结构与缓存命中率而变。
基于公开标价的示意测算,未计任何企业协议;缓存折扣:无公开缓存折扣。
06
常见问题
DeepSeek-V4.1-Flash 要多少钱?
标价为每百万 token 输入 $0.14、输出 $0.28。无公开缓存折扣。DeepSeek App 免费;开源权重可自托管
DeepSeek-V4.1-Flash 的上下文窗口多大,端到端可用吗?
标称 1M 窗口、最大输出 128K;有效上下文得分 98/100,它更能预测长文档细节是否被真正记住。
DeepSeek-V4.1-Flash 编码强吗?
编码综合分 89/100,27 款中第5。属于智能体、多文件工程的第一梯队。
DeepSeek-V4.1-Flash 可以自托管吗?
可以——它提供开源权重且支持私有化部署,你能在自有基础设施上运行以掌控数据,但要预算 GPU 与运维。
它的中文与多模态输入能力如何?
中文分 86,英文 84;多模态综合 78/100(第16),接受 text、image。