对比

DeepSeek V4.1 Flash 对比 V4 Pro 与 V4 Flash:性能全面反超,价格仅为 Pro 的三成

DeepSeek V4.1 Flash 在官方基准上全面超越 V4 Pro(DeepSWE v1.1:74.2 vs 62.7),高峰输出价约 V4 Pro 的三成;V4 Pro 将于 2026 年 9 月 14 日下线。

一句话总结

DeepSeek V4.1 Flash 于 2026 年 9 月 10 日发布,在 DeepSeek 官方基准上全面超越 V4 Pro(DeepSWE v1.1:74.2 对 62.7),高峰时段输出价格仅为 V4 Pro 的约 30%;V4 Pro 将于 2026 年 9 月 14 日 12:00 下线,请求自动转至 V4.1 Flash 并按 Flash 价格计费。

对象简介

DeepSeek V4.1 Flash:2026 年 9 月 10 日发布,采用全新 Causal-Encoder-Decoder(因果编码器—解码器)结构,原生支持视觉理解,MIT 协议开源,权重已上传 Hugging Face。

DeepSeek V4 Pro:V4 系列旗舰模型,总参数量约 1.6 万亿(激活约 490 亿),面向复杂推理与 Agent 任务;官方已宣布其服务将于 2026 年 9 月 14 日 12:00(北京时间)下线。

DeepSeek V4 Flash(旧版):2026 年 7 月 31 日发布的 V4 Flash 正式版,总参数量约 2840 亿(激活约 130 亿);现已下线,请求由 V4.1 Flash 承接。

核心参数对比

维度V4 ProV4 Flash(旧版)V4.1 Flash
架构V4 MoEV4 MoEV4.1 Causal Encoder-Decoder(40 层)
总参数量约 1.6 万亿约 2840 亿5520 亿(含视觉编码器 7630 亿)
激活参数约 490 亿约 130 亿输入 80 亿 / 输出 160 亿
上下文窗口100 万 Token100 万 Token100 万 Token
最大输出384K Token384K Token384K Token
视觉理解未披露独立 Vision-Exp 版原生支持(DeepSeek-ViT)
开源未披露未披露MIT,权重已开源(Hugging Face)
并发上限50025002500
空闲时段输出价1.98 美元/百万 Token0.66 美元/百万 Token0.60 美元/百万 Token(4 元)
高峰时段输出价3.96 美元/百万 Token1.32 美元/百万 Token1.20 美元/百万 Token(8 元)
API 状态9 月 14 日下线,请求转至 V4.1 Flash已下线,由 V4.1 Flash 承接已上线,模型 id:deepseek-flash

关键差异

  1. 性能全面反超:DeepSeek 官方基准中,V4.1 Flash 在 DeepSWE v1.1 得分 74.2,高于 V4 Pro 的 62.7 与 V4 Flash 的 54.4;Terminal-Bench 2.1 得分 90.6(V4 Pro 为 87.9),CyberGym 得分 88.1(V4 Pro 为 83.3)。
  2. 成本大幅下降:高峰时段输出价 1.20 美元/百万 Token,约为 V4 Pro(3.96 美元)的 30%;缓存命中输入价 0.006 美元,较 V4 Pro 下降约 86%。
  3. 架构革新:输入与输出不对称激活(8B/16B),为读取大量上下文、生成少量输出的 Agent 任务优化计算开销。
  4. 视觉并入主力:旧版 V4 Flash 及视觉实验版的请求全部由 V4.1 Flash 承接,文字与图片处理进入同一个主力 API 模型。

选购建议

  • 需要高性价比日常与 Agent 任务的开发者:直接使用 V4.1 Flash(模型 id:deepseek-flash),性能更强、价格更低。
  • 仍在调用 V4 Pro 的生产环境:2026 年 9 月 14 日 12:00 后请求自动转至 V4.1 Flash 并按 Flash 价格计费,无需改代码,但建议提前用相同提示词做输出对比验证。
  • 截至 2026 年 9 月 10 日,V4.1 Flash 的基准数据均来自 DeepSeek 官方公布,尚未有独立第三方复测。

数据来源与参考