DataLearner 标志

DeepSeek-V4-ProvsQwen3.8-Max

在 5 个共同 benchmark 中,Qwen3.8-Max 整体领先:DeepSeek-V4-Pro 领先 0 项,Qwen3.8-Max 领先 5 项,持平 0 项,平均分差 -12.88。

DeepSeek-AI
DeepSeek-V4-Pro

DeepSeek-AI · 2026-08-13 · 推理大模型

阿里巴巴
Qwen3.8-Max

阿里巴巴 · 2026-08-03 · 推理大模型

DeepSeek-V4-Pro0 项(0%)(100%)5 项Qwen3.8-Max

评测分数

按能力类目分组,每组内按分差大小排列;共 5 项。

仓库修复与多文件工程

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
NL2Repo-Bench38.5018 / 18Extra-High (With Tools)55.9011 / 18Extra-High (With Tools)-17.40

办公与文档流程

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
AutomationBench12.8028 / 28Extra-High (With Tools)27.3023 / 28Extra-High (With Tools)-14.50

自主开发与终端任务

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
Terminal-Bench 2.172.1041 / 61Extra-High (With Tools)86.6015 / 61Extra-High (With Tools)-14.50

跨应用与工具编排

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
Toolathlon-Verified55.9029 / 35Extra-High (With Tools)72.5019 / 35Extra-High (With Tools)-16.60

跨能力综合测试

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
SuperCLUE70.106 / 13Reported best (effort unspecified)71.483 / 13Reported best (effort unspecified)-1.38

规格对比

字段DeepSeek-V4-ProQwen3.8-Max
发布机构DeepSeek-AI阿里巴巴
发布时间2026-08-132026-08-03
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模1.6万亿2.4万亿
上下文长度1M1M
最大输出384K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项DeepSeek-V4-ProQwen3.8-Max
文本输入$0.435 / 1M tokens¥12 / 1M tokens
文本输出$0.87 / 1M tokens¥36 / 1M tokens
缓存读取$0.003625 / 1M tokens¥1.5 / 1M tokens

小结

  • Qwen3.8-Max在以下类目领先:仓库修复与多文件工程 (1/1)、办公与文档流程 (1/1)、自主开发与终端任务 (1/1)、跨应用与工具编排 (1/1)、跨能力综合测试 (1/1)

5 个共同 benchmark 上,Qwen3.8-Max 平均高出 12.88 分。

单项差距最大的 benchmark:NL2Repo-Bench — DeepSeek-V4-Pro 38.50,Qwen3.8-Max 55.90(分差 -17.40)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。