DataLearner 标志

Muse Glimmer-30BvsQwen3.6-35B-A3B

在 4 个共同 benchmark 中,Muse Glimmer-30B 整体领先:Muse Glimmer-30B 领先 4 项,Qwen3.6-35B-A3B 领先 0 项,持平 0 项,平均分差 +1.72。

Facebook AI研究实验室
Muse Glimmer-30B

Facebook AI研究实验室 · 2026-08-10 · 推理大模型

阿里巴巴
Qwen3.6-35B-A3B

阿里巴巴 · 2026-04-16 · 推理大模型

Muse Glimmer-30B4 (100%)(0%)0 Qwen3.6-35B-A3B

评测分数

按能力类目分组,每组内按分差大小排列;共 4 项。

Coding and Software Engineer

Muse Glimmer-30B 领先 2/2
评测项Muse Glimmer-30BQwen3.6-35B-A3B分差
SWE-bench Verified7637 / 114Thinking High (With Tools)73.4048 / 114Thinking (No Tools)+2.60
SWE-Bench Pro - Public51.2041 / 57Thinking High (With Tools)49.5046 / 57Thinking (No Tools)+1.70

General Knowledge

Muse Glimmer-30B 领先 1/1
评测项Muse Glimmer-30BQwen3.6-35B-A3B分差
HLE22117 / 181Thinking High (No Tools)21.40123 / 181Thinking (No Tools)+0.60

Math and Reasoning

Muse Glimmer-30B 领先 1/1
评测项Muse Glimmer-30BQwen3.6-35B-A3B分差
AIME 202694.706 / 19Thinking High (No Tools)92.7010 / 19Thinking (No Tools)+2

规格对比

字段Muse Glimmer-30BQwen3.6-35B-A3B
发布机构Facebook AI研究实验室阿里巴巴
发布时间2026-08-102026-04-16
模型类型推理大模型推理大模型
架构稠密模型MoE 架构
参数规模296亿350亿
上下文长度128K+200K
最大输出暂无数据80K

小结

  • Muse Glimmer-30B在以下类目领先:Coding and Software Engineer (2/2)、General Knowledge (1/1)、Math and Reasoning (1/1)

4 个共同 benchmark 上,Muse Glimmer-30B 平均高出 1.72 分。

单项差距最大的 benchmark:SWE-bench Verified — Muse Glimmer-30B 76,Qwen3.6-35B-A3B 73.40(分差 +2.60)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。