DataLearner logo

Qwen3-0.6B Benchmark Details

Qwen3-0.6B currently shows benchmark results led by HLE (472 / 568, score 5.60), τ²-Bench - Telecom (244 / 264, score 21.10), AIME2025 (201 / 215, score 18).

Benchmark Results

Qwen3-0.6B

Benchmark Results

Thinking
Tool usage

Knowledge Exams

2 evaluations
Benchmark / mode
Score
Rank/total
HLE
Standard Mode
4.90
492 / 568
HLE
Thinking Enabled
5.60
472 / 568

Scientific Reasoning

2 evaluations
Benchmark / mode
Score
Rank/total
GPQA Diamond
Standard Mode
23.10
459 / 461
GPQA Diamond
Thinking Enabled
23.90
458 / 461

Algorithmic Coding

2 evaluations
Benchmark / mode
Score
Rank/total
LiveCodeBench
Standard Mode
7.30
249 / 251
LiveCodeBench
Thinking Enabled
12.10
247 / 251

Mathematics

2 evaluations
Benchmark / mode
Score
Rank/total
AIME2025
Standard Mode
10.30
208 / 215
AIME2025
Thinking Enabled
18
201 / 215

Service Workflows

2 evaluations
Benchmark / mode
Score
Rank/total
τ²-Bench - Telecom
Standard ModeTools
14.60
259 / 264
τ²-Bench - Telecom
Thinking EnabledTools
21.10
244 / 264

Instruction Following

2 evaluations
Benchmark / mode
Score
Rank/total
IF Bench
Standard Mode
21.90
277 / 282
IF Bench
Thinking Enabled
23.30
276 / 282