GLM-5.3-FlashvsGemini 3.7 Flash
在 6 个共同 benchmark 中,GLM-5.3-Flash 整体领先:GLM-5.3-Flash 领先 3 项,Gemini 3.7 Flash 领先 2 项,持平 1 项,平均分差 +43.95。
GLM-5.3-Flash
智谱AI · 2026-08-26 · 多模态大模型
Gemini 3.7 Flash
Google Deep Mind · 2026-08-13 · 多模态大模型
GLM-5.3-Flash3 项(50%)持平1(33%)2 项Gemini 3.7 Flash
评测分数
按能力类目分组,每组内按分差大小排列;共 6 项。
AI Agent - Tool Usage
胶着 2/2| 评测项 | GLM-5.3-Flash | Gemini 3.7 Flash | 分差 |
|---|---|---|---|
| AutomationBench | 48.801 / 9Max (With Tools) | 30.405 / 9Thinking (With Tools) | +18.40 |
| Terminal-Bench 2.1 | 84.3011 / 46Max (With Tools) | 85.809 / 46Thinking (With Tools) | -1.50 |
Agent Level Benchmark
胶着 1/1| 评测项 | GLM-5.3-Flash | Gemini 3.7 Flash | 分差 |
|---|---|---|---|
| Agents' Last Exam | 26.308 / 13Max (With Tools) | 26.308 / 13Thinking Medium (With Tools) | 持平 |
Coding and Software Engineer
Gemini 3.7 Flash 领先 1/1| 评测项 | GLM-5.3-Flash | Gemini 3.7 Flash | 分差 |
|---|---|---|---|
| DeepSWE | 63.4011 / 30Max (With Tools) | 65.3010 / 30Thinking High (With Tools) | -1.90 |
Multimodal Understanding
GLM-5.3-Flash 领先 1/1| 评测项 | GLM-5.3-Flash | Gemini 3.7 Flash | 分差 |
|---|---|---|---|
| CharXiv RQ | 89.404 / 18Max (With Tools) | 88.706 / 18Thinking Medium (With Tools) | +0.70 |
Productivity Knowledge
GLM-5.3-Flash 领先 1/1| 评测项 | GLM-5.3-Flash | Gemini 3.7 Flash | 分差 |
|---|---|---|---|
| GDPval-AA v2 | 1,7732 / 15Max (With Tools) | 1,52510 / 15Thinking (No Tools) | +248 |
规格对比
| 字段 | GLM-5.3-Flash | Gemini 3.7 Flash |
|---|---|---|
| 发布机构 | 智谱AI | Google Deep Mind |
| 发布时间 | 2026-08-26 | 2026-08-13 |
| 模型类型 | 多模态大模型 | 多模态大模型 |
| 架构 | MoE 架构 | 稠密模型 |
| 参数规模 | 3200亿 | 暂无数据 |
| 上下文长度 | 1M | 1M |
| 最大输出 | 128K | 64K |
API 调用价格
价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。
| 价格项 | GLM-5.3-Flash | Gemini 3.7 Flash |
|---|---|---|
| 文本输入 | $0.075 / 1M tokens | $0.75 / 1M tokens |
| 文本输出 | $0.25 / 1M tokens | $3.75 / 1M tokens |
| 缓存读取 | $0.015 / 1M tokens | $0.075 / 1M tokens |
小结
- GLM-5.3-Flash在以下类目领先:Multimodal Understanding (1/1)、Productivity Knowledge (1/1)
- Gemini 3.7 Flash在以下类目领先:Coding and Software Engineer (1/1)
- 胶着类目:AI Agent - Tool Usage、Agent Level Benchmark
6 个共同 benchmark 上,GLM-5.3-Flash 平均高出 43.95 分。
单项差距最大的 benchmark:GDPval-AA v2 — GLM-5.3-Flash 1,773,Gemini 3.7 Flash 1,525(分差 +248)。
本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。