DeepSeek-V4-Pro 的最新 API 版本是什么?
当前官方 API 文档列出的版本是 DeepSeek-V4-Pro-0813,调用名仍为 deepseek-v4-pro,无需改动现有 API model 参数。
DeepSeek V4 Pro
DeepSeek-V4-Pro 是 DeepSeek V4 系列的高配档模型,2026 年 4 月 24 日以预览形式亮相,2026 年 8 月 13 日正式转正为 DeepSeek-V4-Pro-0813,调用名仍为 deepseek-v4-pro 不变。V4 是 DeepSeek 继 V3 之后的首个新架构,也是其第一次做 Flash / Pro 双档产品线:混合注意力结合 Compressed Sparse Attention 与 Heavily Compressed Attention,并用 mHC 超连接强化残差传播、以 Muon 优化器训练;在 1M 上下文场景下单 token 推理 FLOPs 仅为 DeepSeek-V3.2 的 27%、KV cache 仅为 10%。模型为纯文本 MoE,1.6T 总参数 / 49B 激活,支持 1M 上下文、384K 最大输出、非思考 / Think High / Think Max 三种模式,接口覆盖 Chat Completions、Responses API、Anthropic 兼容接口、JSON Output 和 Tool Calls。价格为每百万 tokens 缓存未命中输入 0.435 美元、缓存命中 0.003625 美元、输出 0.87 美元,缓存命中比未命中低两个数量级。需注意公开 Hugging Face checkpoint 仍标注为 preview,不能直接视为 0813 API 权重。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
DeepSeek-V4-Pro 当前已收录的代表性评测结果包括 LiveCodeBench(1 / 127,得分 93.50)、MMLU Pro(11 / 133,得分 87.50)、SWE-bench Verified(11 / 115,得分 80.60)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
DeepSeek-V4-Pro 是 DeepSeek V4 系列的高配档模型。它的时间线分两步:2026 年 4 月 24 日以预览形式亮相,2026 年 8 月 13 日正式转正,官方 API 文档把 deepseek-v4-pro 对应的版本更新为 DeepSeek-V4-Pro-0813。
需要注意的是调用名没有变,仍然是 deepseek-v4-pro,所以已有代码不需要改模型名,但拿到的其实已经是 0813 构建。这也是本站不为 0813 单独建条目、而是直接更新本页的原因。
V4 系列是 DeepSeek 实验室继 V3 之后的首个新架构,也是它第一次做双档产品线(Flash 与 Pro)。核心改动有两处:
这些改动带来的收益是可量化的:在 1M tokens 上下文场景下,DeepSeek-V4-Pro 的单 token 推理 FLOPs 只有 DeepSeek-V3.2 的 27%,KV cache 只有 10%。这就是它能以极低价格提供百万上下文的技术前提。
模型为纯文本输入输出的 MoE 结构,1.6 万亿总参数 / 490 亿激活参数,支持 1M tokens 上下文与最高 384K tokens 输出,知识截止 2025 年 5 月。思考模式分为非思考、Think High 与 Think Max,默认启用思考。
接口侧支持 OpenAI 兼容的 Chat Completions、Responses API、Anthropic 兼容接口、JSON Output、Tool Calls、前缀补全,以及仅限非思考模式的 FIM 补全,官方文档列出的并发上限为 500。
官方价格页按每百万 tokens 计费:缓存未命中输入 0.435 美元、缓存命中输入 0.003625 美元、输出 0.87 美元。缓存命中价格比未命中低两个数量级,这意味着对有大量重复前缀的场景(长 system prompt、多轮对话、批量同模板任务),把缓存用好和用不好的账单差距会非常夸张。
官方曾提到未来可能显著调价,但没有公布生效日期与新费率。另外,如果预算比性能更重要,可以对比同系列的 Flash 档:公开分析显示 Flash 在多数基准上只比 Pro 低约 1–2 分,API 成本却低约 12 倍。
DeepSeek 官方 Hugging Face 页面上的公开 checkpoint 仍被描述为 V4 系列的 preview 版本,并且没有说明该权重就等同于 0813 的 API 构建。所以在 DeepSeek 明确说明之前,不应把「自己下载的权重」和「线上 API 返回的结果」当成同一个版本——做复现实验或做能力评估时,这个差别可能直接影响结论。
同样地,官方目前也没有为 0813 发布独立的评测表,本页保留的是 V4 Pro / 公开 checkpoint 已有的评测数据,不会把旧成绩标注为 0813 的新成绩。
当前官方 API 文档列出的版本是 DeepSeek-V4-Pro-0813,调用名仍为 deepseek-v4-pro,无需改动现有 API model 参数。
官方当前记录的是纯文本输入和文本输出,不支持图像输入。
模型总参数为 1.6T、每 token 激活 49B 参数,上下文窗口为 1M tokens,最大输出为 384K tokens。
支持 OpenAI 兼容 Chat Completions、Responses API、Anthropic 兼容接口、JSON Output、Tool Calls、前缀补全,以及非思考模式下的 FIM 补全;文档并发上限为 500。
当前每百万 tokens 的美元价格为:缓存命中输入 $0.003625、缓存未命中输入 $0.435、输出 $0.87,共 3 条有效计价规则。尚未公布的未来调价不计入当前价格。
官方 Hugging Face 页仍将公开 checkpoint 标注为 preview,未声明它就是 0813 API 权重;当前 API 文档也没有独立的 0813 官方评测表,因此本站保留既有 V4 Pro 评测并明确其版本边界。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
