DataLearner 标志

GLM-5.3vsDeepSeek-V4-Pro

在 8 个共同 benchmark 中,GLM-5.3 整体领先:GLM-5.3 领先 6 项,DeepSeek-V4-Pro 领先 2 项,持平 0 项,平均分差 +9.39。

智谱AI
GLM-5.3

智谱AI · 2026-08-14 · 推理大模型

DeepSeek-AI
DeepSeek-V4-Pro

DeepSeek-AI · 2026-08-13 · 推理大模型

GLM-5.36 (75%)(25%)2 DeepSeek-V4-Pro

评测分数

按能力类目分组,每组内按分差大小排列;共 8 项。

AI Agent - Tool Usage

GLM-5.3 领先 3/4
评测项GLM-5.3DeepSeek-V4-Pro分差
Automation Bench48.201 / 7Max (With Tools)31.802 / 7极高强度思考(工具)+16.40
CyberGym84.501 / 3Max (With Tools)83.302 / 3极高强度思考(工具)+1.20
Toolathlon-Verified733 / 5Max (With Tools)74.102 / 5极高强度思考(工具)-1.10
Terminal-Bench 2.188.203 / 43Max (With Tools)87.906 / 43极高强度思考(工具)+0.30

Coding and Software Engineer

胶着 2/2
评测项GLM-5.3DeepSeek-V4-Pro分差
DeepSWE66.908 / 26Max (With Tools)62.7011 / 26极高强度思考(工具)+4.20
NL2Repo-Bench582 / 7Max (With Tools)61.501 / 7极高强度思考(工具)-3.50

Agent Level Benchmark

GLM-5.3 领先 1/1
评测项GLM-5.3DeepSeek-V4-Pro分差
Agents' Last Exam28.504 / 10Max (With Tools)25.708 / 10极高强度思考(工具)+2.80

General Knowledge

GLM-5.3 领先 1/1
评测项GLM-5.3DeepSeek-V4-Pro分差
HLE62.503 / 181Max (With Tools)7.70165 / 181Normal (No Tools)+54.80

规格对比

字段GLM-5.3DeepSeek-V4-Pro
发布机构智谱AIDeepSeek-AI
发布时间2026-08-142026-08-13
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模7533.3亿1.6万亿
上下文长度1M1M
最大输出128K384K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GLM-5.3DeepSeek-V4-Pro
文本输入暂无公开价格$0.435 / 1M tokens
文本输出暂无公开价格$0.87 / 1M tokens
缓存读取暂无公开价格$0.003625 / 1M tokens

部分模型公开价格不完整,缺失字段按"暂无公开价格"展示。

小结

  • GLM-5.3在以下类目领先:AI Agent - Tool Usage (3/4)、Agent Level Benchmark (1/1)、General Knowledge (1/1)
  • 胶着类目:Coding and Software Engineer

8 个共同 benchmark 上,GLM-5.3 平均高出 9.39 分。

单项差距最大的 benchmark:HLE — GLM-5.3 62.50,DeepSeek-V4-Pro 7.70(分差 +54.80)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。