MModelspectra独立 AI 模型情报
模型档案 · 更新于 2026-09-08
English
模型档案 · DeepSeek · 中国大陆

DeepSeek-V4.1-Flash

552B MoE,prefill 激活 8B、decode 激活 16B。CED 编解码使 prefill 计算近似减半;CSA2 跨层 KV 共享叠加 FP4,把全局 KV 压到约 1/4、持久化 KV 压到约 1/8。在完整 model card 发布前,价格 / 规格字段沿用 V4-Flash 档估算。

最擅长长上下文 AI 智能体、智能体编码、高吞吐部署
授权开源权重
更新于2026-09-08
01

快照

综合
76
27 款中第12
编码
89
27 款中第5
多模态
78
27 款中第16
输入 / 输出
$0.14 / $0.28
每百万 token 美元价
上下文
1M
可用记忆 98
速度
约 85 tok/s
首 token 0.3s

聚合自公开信息并独立加权,方法见 条款 页。3 分以内视为统计持平。

02

规格与价格

收录的每个字段。标价为每百万 token 的美元价;采购前请核对厂商实时定价。

厂商DeepSeek(中国大陆)
发布 / 当前版本2026.09
授权方式开源权重
上下文窗口1M
最大输出128K
有效上下文得分98
输入 / 输出价格$0.14 / $0.28 每百万 token
缓存折扣无公开缓存折扣
免费档DeepSeek App 免费;开源权重可自托管
速度 / 首 token约 85 tok/s / 0.3s
函数调用84
拒答率约 5%
英文 / 中文84 / 86
模态text、image
微调
私有化部署是(企业)
SOC2 / 不训练否 / 是
03

优势与注意点

优势

  • 1M 上下文,全局 KV 约 890 字节/token
  • 智能体编码顶尖(DeepSWE 74.2、Terminal-Bench 2.1 90.6)
  • 有界重放把持久化 KV 压到约 1/8
  • 开源权重,服务成本极低

注意点

  • 最难科学智能体仍有差距(Terminal-Bench 4.0)
  • 多模态不及顶级闭源模型
  • 生态较新、较小
04

在 27 款模型中的排名

综合 76/100(第12),编码 89(第5),多模态 78(第16)。完整榜单与并排对比见 排行榜
05

实际价格

示意月度账单,按 1 亿输入 + 3000 万输出 token:标价 $22。实际随你的结构与缓存命中率而变。

基于公开标价的示意测算,未计任何企业协议;缓存折扣:无公开缓存折扣。

06

常见问题

DeepSeek-V4.1-Flash 要多少钱?
标价为每百万 token 输入 $0.14、输出 $0.28。无公开缓存折扣。DeepSeek App 免费;开源权重可自托管
DeepSeek-V4.1-Flash 的上下文窗口多大,端到端可用吗?
标称 1M 窗口、最大输出 128K;有效上下文得分 98/100,它更能预测长文档细节是否被真正记住。
DeepSeek-V4.1-Flash 编码强吗?
编码综合分 89/100,27 款中第5。属于智能体、多文件工程的第一梯队。
DeepSeek-V4.1-Flash 可以自托管吗?
可以——它提供开源权重且支持私有化部署,你能在自有基础设施上运行以掌控数据,但要预算 GPU 与运维。
它的中文与多模态输入能力如何?
中文分 86,英文 84;多模态综合 78/100(第16),接受 text、image。