DataLearner 标志

Muse Glimmer-30BvsMuse Spark 1.1

在 5 个共同 benchmark 中,Muse Spark 1.1 整体领先:Muse Glimmer-30B 领先 0 项,Muse Spark 1.1 领先 5 项,持平 0 项,平均分差 -21.24。

Facebook AI研究实验室
Muse Glimmer-30B

Facebook AI研究实验室 · 2026-08-10 · 推理大模型

Facebook AI研究实验室
Muse Spark 1.1

Facebook AI研究实验室 · 2026-07-09 · 推理大模型

Muse Glimmer-30B0 (0%)(100%)5 Muse Spark 1.1

评测分数

按能力类目分组,每组内按分差大小排列;共 5 项。

AI Agent - Tool Usage

Muse Spark 1.1 领先 3/3
评测项Muse Glimmer-30BMuse Spark 1.1分差
Terminal-Bench 2.151.7044 / 44Thinking High (With Tools)8019 / 44Thinking (With Tools)-28.30
OSWorld-Verified65.9020 / 26Thinking High (With Tools)80.807 / 26Thinking (With Tools)-14.90
MCP-Atlas75.5020 / 38Thinking High (With Tools)88.101 / 38Thinking (With Tools)-12.60

Coding and Software Engineer

Muse Spark 1.1 领先 1/1
评测项Muse Glimmer-30BMuse Spark 1.1分差
SWE-Bench Pro - Public51.2041 / 57Thinking High (With Tools)61.5011 / 57Thinking (With Tools)-10.30

General Knowledge

Muse Spark 1.1 领先 1/1
评测项Muse Glimmer-30BMuse Spark 1.1分差
HLE22117 / 181Thinking High (No Tools)62.104 / 181Thinking (With Tools)-40.10

规格对比

字段Muse Glimmer-30BMuse Spark 1.1
发布机构Facebook AI研究实验室Facebook AI研究实验室
发布时间2026-08-102026-07-09
模型类型推理大模型推理大模型
架构稠密模型稠密模型
参数规模296亿暂无数据
上下文长度128K+1M
最大输出暂无数据暂无数据

小结

  • Muse Spark 1.1在以下类目领先:AI Agent - Tool Usage (3/3)、Coding and Software Engineer (1/1)、General Knowledge (1/1)

5 个共同 benchmark 上,Muse Spark 1.1 平均高出 21.24 分。

单项差距最大的 benchmark:HLE — Muse Glimmer-30B 22,Muse Spark 1.1 62.10(分差 -40.10)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。