一句话总结
DeepSeek V4.1 Flash 于 2026 年 9 月 10 日发布,在 DeepSeek 官方基准上全面超越 V4 Pro(DeepSWE v1.1:74.2 对 62.7),高峰时段输出价格仅为 V4 Pro 的约 30%;V4 Pro 将于 2026 年 9 月 14 日 12:00 下线,请求自动转至 V4.1 Flash 并按 Flash 价格计费。
对象简介
DeepSeek V4.1 Flash:2026 年 9 月 10 日发布,采用全新 Causal-Encoder-Decoder(因果编码器—解码器)结构,原生支持视觉理解,MIT 协议开源,权重已上传 Hugging Face。
DeepSeek V4 Pro:V4 系列旗舰模型,总参数量约 1.6 万亿(激活约 490 亿),面向复杂推理与 Agent 任务;官方已宣布其服务将于 2026 年 9 月 14 日 12:00(北京时间)下线。
DeepSeek V4 Flash(旧版):2026 年 7 月 31 日发布的 V4 Flash 正式版,总参数量约 2840 亿(激活约 130 亿);现已下线,请求由 V4.1 Flash 承接。
核心参数对比
| 维度 | V4 Pro | V4 Flash(旧版) | V4.1 Flash |
|---|---|---|---|
| 架构 | V4 MoE | V4 MoE | V4.1 Causal Encoder-Decoder(40 层) |
| 总参数量 | 约 1.6 万亿 | 约 2840 亿 | 5520 亿(含视觉编码器 7630 亿) |
| 激活参数 | 约 490 亿 | 约 130 亿 | 输入 80 亿 / 输出 160 亿 |
| 上下文窗口 | 100 万 Token | 100 万 Token | 100 万 Token |
| 最大输出 | 384K Token | 384K Token | 384K Token |
| 视觉理解 | 未披露 | 独立 Vision-Exp 版 | 原生支持(DeepSeek-ViT) |
| 开源 | 未披露 | 未披露 | MIT,权重已开源(Hugging Face) |
| 并发上限 | 500 | 2500 | 2500 |
| 空闲时段输出价 | 1.98 美元/百万 Token | 0.66 美元/百万 Token | 0.60 美元/百万 Token(4 元) |
| 高峰时段输出价 | 3.96 美元/百万 Token | 1.32 美元/百万 Token | 1.20 美元/百万 Token(8 元) |
| API 状态 | 9 月 14 日下线,请求转至 V4.1 Flash | 已下线,由 V4.1 Flash 承接 | 已上线,模型 id:deepseek-flash |
关键差异
- 性能全面反超:DeepSeek 官方基准中,V4.1 Flash 在 DeepSWE v1.1 得分 74.2,高于 V4 Pro 的 62.7 与 V4 Flash 的 54.4;Terminal-Bench 2.1 得分 90.6(V4 Pro 为 87.9),CyberGym 得分 88.1(V4 Pro 为 83.3)。
- 成本大幅下降:高峰时段输出价 1.20 美元/百万 Token,约为 V4 Pro(3.96 美元)的 30%;缓存命中输入价 0.006 美元,较 V4 Pro 下降约 86%。
- 架构革新:输入与输出不对称激活(8B/16B),为读取大量上下文、生成少量输出的 Agent 任务优化计算开销。
- 视觉并入主力:旧版 V4 Flash 及视觉实验版的请求全部由 V4.1 Flash 承接,文字与图片处理进入同一个主力 API 模型。
选购建议
- 需要高性价比日常与 Agent 任务的开发者:直接使用 V4.1 Flash(模型 id:deepseek-flash),性能更强、价格更低。
- 仍在调用 V4 Pro 的生产环境:2026 年 9 月 14 日 12:00 后请求自动转至 V4.1 Flash 并按 Flash 价格计费,无需改代码,但建议提前用相同提示词做输出对比验证。
- 截至 2026 年 9 月 10 日,V4.1 Flash 的基准数据均来自 DeepSeek 官方公布,尚未有独立第三方复测。
