DataLearner logo

Muse Glimmer-30BvsQwen3.6-35B-A3B

Across 4 shared benchmarks, Muse Glimmer-30B leads overall: Muse Glimmer-30B wins 4, Qwen3.6-35B-A3B wins 0, with 0 ties and an average score difference of +1.72.

Facebook AI研究实验室
Muse Glimmer-30B

Facebook AI研究实验室 · 2026-08-10 · Reasoning model

阿里巴巴
Qwen3.6-35B-A3B

阿里巴巴 · 2026-04-16 · Reasoning model

Muse Glimmer-30B4 wins(100%)(0%)0 winsQwen3.6-35B-A3B

Benchmark scores

Grouped by capability, sorted by largest gap within each. 4 shared benchmarks.

Coding and Software Engineer

Muse Glimmer-30B 2/2
BenchmarkMuse Glimmer-30BQwen3.6-35B-A3BDiff
SWE-bench Verified7637 / 114Thinking High (With Tools)73.4048 / 114Thinking (No Tools)+2.60
SWE-Bench Pro - Public51.2041 / 57Thinking High (With Tools)49.5046 / 57Thinking (No Tools)+1.70

General Knowledge

Muse Glimmer-30B 1/1
BenchmarkMuse Glimmer-30BQwen3.6-35B-A3BDiff
HLE22117 / 181Thinking High (No Tools)21.40123 / 181Thinking (No Tools)+0.60

Math and Reasoning

Muse Glimmer-30B 1/1
BenchmarkMuse Glimmer-30BQwen3.6-35B-A3BDiff
AIME 202694.706 / 19Thinking High (No Tools)92.7010 / 19Thinking (No Tools)+2

Specs

FieldMuse Glimmer-30BQwen3.6-35B-A3B
PublisherFacebook AI研究实验室阿里巴巴
Release date2026-08-102026-04-16
Model typeReasoning modelReasoning model
ArchitectureDenseMoE
Parameters29.6B35B
Context length128K+200K
Max outputNot available80K

Summary

  • Muse Glimmer-30Bleads in:Coding and Software Engineer (2/2), General Knowledge (1/1), Math and Reasoning (1/1)

On average across the 4 shared benchmarks, Muse Glimmer-30B scores 1.72 higher.

Largest single-benchmark gap: SWE-bench Verified — Muse Glimmer-30B 76 vs Qwen3.6-35B-A3B 73.40 (+2.60).

Page generated from structured model, pricing and benchmark records. No real-time LLM is used to write the prose.