DataLearner 标志

Muse Glimmer-30BvsGemma 4 31B

在 3 个共同 benchmark 中,Gemma 4 31B 整体领先:Muse Glimmer-30B 领先 1 项,Gemma 4 31B 领先 2 项,持平 0 项,平均分差 +0.07。

Facebook AI研究实验室
Muse Glimmer-30B

Facebook AI研究实验室 · 2026-08-10 · 推理大模型

DeepMind
Gemma 4 31B

DeepMind · 2026-04-02 · 聊天大模型

Muse Glimmer-30B1 (33%)(67%)2 Gemma 4 31B

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

General Knowledge

Gemma 4 31B 领先 1/1
评测项Muse Glimmer-30BGemma 4 31B分差
HLE22117 / 181Thinking High (No Tools)26.50104 / 181Thinking (With Tools + Internet)-4.50

Math and Reasoning

Muse Glimmer-30B 领先 1/1
评测项Muse Glimmer-30BGemma 4 31B分差
AIME 202694.706 / 19Thinking High (No Tools)89.2016 / 19Thinking (No Tools)+5.50

科学与综合推理

Gemma 4 31B 领先 1/1
评测项Muse Glimmer-30BGemma 4 31B分差
GPQA Diamond83.5098 / 226Thinking High (No Tools)84.3093 / 226Thinking (No Tools)-0.80

规格对比

字段Muse Glimmer-30BGemma 4 31B
发布机构Facebook AI研究实验室DeepMind
发布时间2026-08-102026-04-02
模型类型推理大模型聊天大模型
架构稠密模型稠密模型
参数规模296亿307亿
上下文长度128K+256K
最大输出暂无数据32K

小结

  • Muse Glimmer-30B在以下类目领先:Math and Reasoning (1/1)
  • Gemma 4 31B在以下类目领先:General Knowledge (1/1)、科学与综合推理 (1/1)

3 个共同 benchmark 上,Muse Glimmer-30B 平均高出 0.07 分。

单项差距最大的 benchmark:AIME 2026 — Muse Glimmer-30B 94.70,Gemma 4 31B 89.20(分差 +5.50)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。