DataLearner 标志

Qwen3.8-Max-0902vsGLM-5.3

在 7 个共同 benchmark 中,Qwen3.8-Max-0902 整体领先:Qwen3.8-Max-0902 领先 7 项,GLM-5.3 领先 0 项,持平 0 项,平均分差 +3.46。

阿里巴巴
Qwen3.8-Max-0902

阿里巴巴 · 2026-09-02 · 推理大模型

智谱AI
GLM-5.3

智谱AI · 2026-08-14 · 推理大模型

Qwen3.8-Max-09027 (100%)(0%)0 GLM-5.3

评测分数

按能力类目分组,每组内按分差大小排列;共 7 项。

Coding and Software Engineer

Qwen3.8-Max-0902 领先 4/4
评测项Qwen3.8-Max-0902GLM-5.3分差
Program Bench285 / 7极高强度思考(工具)196 / 7Max (With Tools)+9
NL2Repo-Bench64.901 / 12极高强度思考(工具)584 / 12Max (With Tools)+6.90
DeepSWE69.304 / 32极高强度思考(工具)66.909 / 32Max (With Tools)+2.40
SWE-Marathon44.801 / 6极高强度思考(工具)42.502 / 6Max (With Tools)+2.30

AI Agent - Tool Usage

Qwen3.8-Max-0902 领先 3/3
评测项Qwen3.8-Max-0902GLM-5.3分差
AutomationBench50.801 / 12极高强度思考(工具)48.203 / 12Max (With Tools)+2.60
Terminal-Bench 3.0293 / 7极高强度思考(工具)28.304 / 7Max (With Tools)+0.70
Toolathlon-Verified73.307 / 10极高强度思考(工具)738 / 10Max (With Tools)+0.30

规格对比

字段Qwen3.8-Max-0902GLM-5.3
发布机构阿里巴巴智谱AI
发布时间2026-09-022026-08-14
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模2.4万亿7440亿
上下文长度1M1M
最大输出131K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Qwen3.8-Max-0902GLM-5.3
文本输入$2 / 1M tokens$1.4 / 1M tokens
文本输出$6 / 1M tokens$4.4 / 1M tokens
缓存读取$0.25 / 1M tokens$0.26 / 1M tokens
缓存写入$2.5 / 1M tokens暂无公开价格

小结

  • Qwen3.8-Max-0902在以下类目领先:Coding and Software Engineer (4/4)、AI Agent - Tool Usage (3/3)

7 个共同 benchmark 上,Qwen3.8-Max-0902 平均高出 3.46 分。

单项差距最大的 benchmark:Program Bench — Qwen3.8-Max-0902 28,GLM-5.3 19(分差 +9)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。