GLM-5.3vsKimi K3
在 11 个共同 benchmark 中,GLM-5.3 整体领先:GLM-5.3 领先 6 项,Kimi K3 领先 5 项,持平 0 项,平均分差 +4.06。
GLM-5.36 项(55%)(45%)5 项Kimi K3
评测分数
按能力类目分组,每组内按分差大小排列;共 11 项。
Coding and Software Engineer
Kimi K3 领先 3/5| 评测项 | GLM-5.3 | Kimi K3 | 分差 |
|---|---|---|---|
| Program Bench | 195 / 5Max (With Tools) | 77.801 / 5Max (With Tools) | -58.80 |
| PostTrain Bench | 39.801 / 4Max (With Tools) | 36.603 / 4Max (With Tools) | +3.20 |
| FrontierSWE | 78.102 / 4Max (With Tools) | 81.201 / 4Max (With Tools) | -3.10 |
| DeepSWE | 66.908 / 26Max (With Tools) | 67.505 / 26Max (With Tools) | -0.60 |
| SWE-Marathon | 42.501 / 4Max (With Tools) | 422 / 4Max (With Tools) | +0.50 |
AI Agent - Tool Usage
Kimi K3 领先 2/3| 评测项 | GLM-5.3 | Kimi K3 | 分差 |
|---|---|---|---|
| Automation Bench | 48.201 / 7Max (With Tools) | 30.803 / 7Max (With Tools) | +17.40 |
| Toolathlon-Verified | 733 / 5Max (With Tools) | 76.501 / 5Max (With Tools) | -3.50 |
| Terminal-Bench 2.1 | 88.203 / 43Max (With Tools) | 88.302 / 43Max (With Tools) | -0.10 |
Agent Level Benchmark
GLM-5.3 领先 1/1| 评测项 | GLM-5.3 | Kimi K3 | 分差 |
|---|---|---|---|
| Agents' Last Exam | 28.504 / 10Max (With Tools) | 28.305 / 10Max (With Tools) | +0.20 |
General Knowledge
GLM-5.3 领先 1/1| 评测项 | GLM-5.3 | Kimi K3 | 分差 |
|---|---|---|---|
| HLE | 62.503 / 181Max (With Tools) | 5614 / 181Max (With Tools) | +6.50 |
Productivity Knowledge
GLM-5.3 领先 1/1| 评测项 | GLM-5.3 | Kimi K3 | 分差 |
|---|---|---|---|
| GDPval-AA v2 | 1,7692 / 13Max (With Tools) | 1,6866 / 13Max (With Tools) | +83 |
规格对比
| 字段 | GLM-5.3 | Kimi K3 |
|---|---|---|
| 发布机构 | 智谱AI | Moonshot AI |
| 发布时间 | 2026-08-14 | 2026-07-16 |
| 模型类型 | 推理大模型 | 推理大模型 |
| 架构 | MoE 架构 | MoE 架构 |
| 参数规模 | 7533.3亿 | 2.8万亿 |
| 上下文长度 | 1M | 1M |
| 最大输出 | 128K | 1M |
API 调用价格
价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。
| 价格项 | GLM-5.3 | Kimi K3 |
|---|---|---|
| 文本输入 | 暂无公开价格 | ¥20 / 1M tokens |
| 文本输出 | 暂无公开价格 | ¥100 / 1M tokens |
| 缓存读取 | 暂无公开价格 | ¥2 / 1M tokens |
部分模型公开价格不完整,缺失字段按"暂无公开价格"展示。
小结
- GLM-5.3在以下类目领先:Agent Level Benchmark (1/1)、General Knowledge (1/1)、Productivity Knowledge (1/1)
- Kimi K3在以下类目领先:Coding and Software Engineer (3/5)、AI Agent - Tool Usage (2/3)
11 个共同 benchmark 上,GLM-5.3 平均高出 4.06 分。
单项差距最大的 benchmark:GDPval-AA v2 — GLM-5.3 1,769,Kimi K3 1,686(分差 +83)。
本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。