一句话总结
本数据集汇总 DeepSeek V4 系列三个模型(V4 Pro / V4 Flash / V4.1 Flash)的 API 定价与核心规格,价格按高峰/空闲双档列出,截至 2026 年 9 月 10 日 V4.1 Flash 新价格生效。
数据说明
- 数据范围:DeepSeek V4 系列 3 个模型(V4 Pro、V4 Flash、V4.1 Flash)。
- 价格口径:每百万 Token;高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余为空闲时段;人民币价格为官方公告价,美元价格来自官方定价页(Apidog 汇总)。
- 截至日期:2026 年 9 月 10 日(V4.1 Flash 新价格生效日)。
- 状态说明:V4 Flash 已下线、请求由 V4.1 Flash 承接;V4 Pro 将于 2026 年 9 月 14 日 12:00(北京时间)下线并转由 V4.1 Flash 处理。
核心数据
表 1:DeepSeek V4 系列 API 定价(美元 / 每百万 Token)
| model | price_tier | input_cache_hit_usd | input_cache_miss_usd | output_usd |
|---|---|---|---|---|
| V4 Pro | off_peak | 0.022 | 0.66 | 1.98 |
| V4 Pro | peak | 0.044 | 1.32 | 3.96 |
| V4 Flash(旧版) | off_peak | 0.007 | 0.22 | 0.66 |
| V4 Flash(旧版) | peak | 0.014 | 0.44 | 1.32 |
| V4.1 Flash | off_peak | 0.003 | 0.15 | 0.60 |
| V4.1 Flash | peak | 0.006 | 0.30 | 1.20 |
表 2:DeepSeek V4.1 Flash 官方人民币定价(每百万 Token)
| model | price_tier | input_cache_hit_cny | input_cache_miss_cny | output_cny |
|---|---|---|---|---|
| V4.1 Flash | off_peak | 0.02 | 1 | 4 |
| V4.1 Flash | peak | 0.04 | 2 | 8 |
表 3:DeepSeek V4 系列核心规格
| model | architecture | total_params | active_params | context_tokens | max_output_tokens | vision | open_source | concurrency_limit |
|---|---|---|---|---|---|---|---|---|
| V4 Pro | V4 MoE | 约 1.6T | 约 49B | 1M | 384K | 未披露 | 未披露 | 500 |
| V4 Flash(旧版) | V4 MoE | 约 284B | 约 13B | 1M | 384K | 独立 Vision-Exp 版 | 未披露 | 2500 |
| V4.1 Flash | V4.1 Causal Encoder-Decoder(40 层) | 552B | 输入 8B / 输出 16B | 1M | 384K | 原生(DeepSeek-ViT) | MIT(权重已开源) | 2500 |
字段说明
- model:模型名称。
- price_tier:价格档位,peak 为高峰时段(北京时间周一至周五 9:00–12:00、14:00–18:00),off_peak 为空闲时段。
- input_cache_hit_usd / input_cache_miss_usd / output_usd:每百万 Token 输入(缓存命中/未命中)与输出价格,单位美元。
- input_cache_hit_cny / input_cache_miss_cny / output_cny:每百万 Token 输入(缓存命中/未命中)与输出价格,单位人民币。
- total_params:模型总参数量;active_params:每次推理实际激活的参数规模。
- context_tokens:上下文窗口长度;max_output_tokens:单次最大输出长度。
- concurrency_limit:API 并发请求上限。
