DeepSeek V3.2 评测详情
DeepSeek V3.2 当前已收录的代表性评测结果包括 LiveCodeBench(21 / 123,得分 83.30)、AIME2025(30 / 107,得分 93.10)、τ²-Bench(14 / 43,得分 80.30)。本页还提供与 3 个前代或同系列模型的迭代对比。并附有 1 个数据来源链接供参考。
评测结果
DeepSeek V3.2
评测结果
综合评估
共 6 项评测评测名称 / 模式
得分
排名/总数
编程与软件工程
共 5 项评测评测名称 / 模式
得分
排名/总数
数学推理
共 3 项评测评测名称 / 模式
得分
排名/总数
历代版本对比
DeepSeek V3.2 系列各版本的评测成绩纵向对比
评测类别:
柱状图按当前筛选范围内每个模型在各评测中的最高分展示;百分制评测使用原始高度,超出 0-100 的评测按该评测内相对比例缩放,标签仍保留原始分数。
2 项可对比评测得分汇总。每个模型展示最佳得分,模式在分数下方标注。· 点击任意行可切换下方趋势图。
| 评测项 | DeepSeek V3.2当前 | DeepSeek-V3.1 | DeepSeek-V3-0324 |
|---|---|---|---|
SWE-bench Verified 编程与软件工程 | 73.10开启思考 | 工具 | 66.00常规模式 | 38.80常规模式 |
τ²-Bench Agent能力评测 | 80.30开启思考 | 工具 | -- | 38.80常规模式 | 工具 |
单评测历史趋势图
当前查看:SWE-bench Verified · 编程与软件工程
选择评测
DeepSeek V3.2 所在系列的标准 API 价格对比
按模型并排展示标准文本输入价与输出价;若存在超长上下文加价,仅保留阈值内标准价,并在下方说明适用范围。
数据来源:DataLearnerAI,展示默认供应商的标准文本价格。 · USD / 1M tokens
| 模型 | 供应商 | 标准输入 | 标准输出 | 标准价适用于 |
|---|---|---|---|---|
DeepSeek V3.2 | DeepSeek-AI | $0.28 / 1M tokens | $0.42 / 1M tokens | — |
DeepSeek-V3.1 | Fireworks AI | $0.56 / 1M tokens | $1.68 / 1M tokens | — |
DeepSeek-V3-0324 | DeepInfra | $0.2 / 1M tokens | $0.88 / 1M tokens | — |
DeepSeek-V3 | DeepSeek-AI | $0.27 / 1M tokens | $1.1 / 1M tokens | — |