DataLearner logo

QwQ-32B Benchmark Details

QwQ-32B currently shows benchmark results led by AIME 2024 (29 / 62, score 79.50), MMLU Pro (84 / 176, score 76), LiveCodeBench (122 / 250, score 63.10).

Benchmark Results

QwQ-32B

Benchmark Results

Thinking

General Knowledge

3 evaluations
Benchmark / mode
Score
Rank/total
MMLU Pro
Standard Mode
76
84 / 176
MMLU Pro
unknown
69.07
103 / 176
HLE
Thinking Enabled
7.30
435 / 563

Coding and Software Engineer

2 evaluations
Benchmark / mode
Score
Rank/total
LiveCodeBench
Thinking Enabled
63.10
122 / 250
HumanEval
Standard Mode
19
133 / 140

Other

2 evaluations
Benchmark / mode
Score
Rank/total
GPQA Diamond
Standard Mode
58
387 / 462
GPQA Diamond
Thinking Enabled
59.30
382 / 462

Math and Reasoning

3 evaluations
Benchmark / mode
Score
Rank/total
MATH-500
Standard Mode
91
34 / 45
AIME 2024
Standard Mode
79.50
29 / 62
AIME2025
Thinking Enabled
29
185 / 215

Writing and Creative Capabilities

1 evaluations
Benchmark / mode
Score
Rank/total
Creative Writing
Standard Mode
1255.10
78 / 106

Agent Level Benchmark

1 evaluations
Benchmark / mode
Score
Rank/total
Aider-Polyglot
Thinking Enabled
20.90
49 / 59

Instruction Following

1 evaluations
Benchmark / mode
Score
Rank/total
IF Bench
Thinking Enabled
38.80
225 / 282
QwQ-32B Benchmark Results & Rankings | DataLearnerAI