DataLearner 标志

GLM-5.3vsGLM-5.2

在 18 个共同 benchmark 中,GLM-5.3 整体领先:GLM-5.3 领先 16 项,GLM-5.2 领先 1 项,持平 1 项,平均分差 +25.91。

智谱AI
GLM-5.3

智谱AI · 2026-08-14 · 推理大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

GLM-5.316 项(89%)持平1(6%)1 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 18 项。

临床工作与医疗决策

GLM-5.3 领先 2/2
评测项GLM-5.3GLM-5.2分差
MedScribe88.818 / 66Max (With Tools)83.5331 / 66Max (With Tools)+5.28
MedCode42.8637 / 64Max (With Tools)40.7744 / 64Max (With Tools)+2.09

仓库修复与多文件工程

GLM-5.3 领先 2/2
评测项GLM-5.3GLM-5.2分差
SWE-Marathon42.503 / 7Max (With Tools)137 / 7Max (With Tools)+29.50
FrontierSWE78.102 / 4Max (With Tools)74.403 / 4Max (With Tools)+3.70

法律

GLM-5.3 领先 2/2
评测项GLM-5.3GLM-5.2分差
Legal Research Bench49.046 / 42Max (With Tools)31.2529 / 42Max (With Tools)+17.79
Harvey's Legal Agent Benchmark8.3314 / 43Max (With Tools)7.0816 / 43Max (With Tools)+1.25

金融

胶着 2/2
评测项GLM-5.3GLM-5.2分差
Finance Agent v255.8414 / 42Max (With Tools)49.7030 / 42Max (With Tools)+6.14
EMB (Excel Modeling)56.3430 / 42Max (With Tools)61.5324 / 42Max (With Tools)-5.19

写作与创意表达

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
Creative Writing2,0756 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)+318.50

数学

胶着 1/1
评测项GLM-5.3GLM-5.2分差
FrontierMath Tier 4 v229.2720 / 42Max (No Tools)29.2720 / 42Max (No Tools)持平

文档与图表理解

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
GDP.pdf11.2077 / 122Max (No Tools)10.4082 / 122Max (No Tools)+0.80

机器学习工程

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
PostTrain Bench39.801 / 5Max (With Tools)34.305 / 5Max (With Tools)+5.50

科学计算与科研编程

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
SciCode599 / 134Max (No Tools)51.2067 / 134Max (No Tools)+7.80

程序生成与编辑

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
Vibe Code Bench v1.178.1219 / 60Max (With Tools)63.9630 / 60Max (With Tools)+14.16

维护、优化与工程管理

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
Code Migration44.2217 / 43Max (With Tools)37.8722 / 43Max (With Tools)+6.35

自主开发与终端任务

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
Terminal-Bench 4.041.8220 / 97Max (With Tools)185 / 97Max (With Tools)+40.82

跨能力综合测试

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
SuperCLUE71.294 / 13Reported best (effort unspecified)63.2710 / 13Reported best (effort unspecified)+8.02

跨能力聚合指数

GLM-5.3 领先 1/1
评测项GLM-5.3GLM-5.2分差
Vals Index56.9723 / 42Max (With Tools)53.1227 / 42Max (With Tools)+3.85

规格对比

字段GLM-5.3GLM-5.2
发布机构智谱AI智谱AI
发布时间2026-08-142026-06-13
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模7440亿7533.3亿
上下文长度1M1M
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GLM-5.3GLM-5.2
文本输入$1.4 / 1M tokens$1.4 / 1M tokens
文本输出$4.4 / 1M tokens$4.4 / 1M tokens
缓存读取$0.26 / 1M tokens$0.26 / 1M tokens

小结

  • GLM-5.3在以下类目领先:临床工作与医疗决策 (2/2)、仓库修复与多文件工程 (2/2)、法律 (2/2)、写作与创意表达 (1/1)、文档与图表理解 (1/1)、机器学习工程 (1/1)、科学计算与科研编程 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)、跨能力综合测试 (1/1)、跨能力聚合指数 (1/1)
  • 胶着类目:金融、数学

18 个共同 benchmark 上,GLM-5.3 平均高出 25.91 分。

单项差距最大的 benchmark:Creative Writing — GLM-5.3 2,075,GLM-5.2 1,757(分差 +318.50)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。