DataLearner logo

Qwen2.5-72B Benchmark Details

Qwen2.5-72B currently shows benchmark results led by MBPP (13 / 96, score 84.70), GSM8K (13 / 70, score 91.50), TruthfulQA (1 / 4, score 60.40).

Benchmark Results

Qwen2.5-72B

Benchmark Results

Thinking

General Knowledge

3 evaluations
Benchmark / mode
Score
Rank/total
BBH
Standard Mode
86.30
11 / 21
MMLU
Standard Mode
86.10
34 / 124
MMLU Pro
Standard Mode
58.10
125 / 176

Math and Reasoning

2 evaluations
Benchmark / mode
Score
Rank/total
GSM8K
Standard Mode
91.50
13 / 70
MATH
Standard Mode
62.10
29 / 42

Coding and Software Engineer

2 evaluations
Benchmark / mode
Score
Rank/total
MBPP
Standard Mode
84.70
13 / 96
HumanEval
Standard Mode
59.10
75 / 140

Other

1 evaluations
Benchmark / mode
Score
Rank/total
TruthfulQA
Standard Mode
60.40
1 / 4

Other

1 evaluations
Benchmark / mode
Score
Rank/total
GPQA Diamond
Standard Mode
45.90
421 / 462
Qwen2.5-72B Benchmark Results & Rankings | DataLearnerAI