DataLearner logo

Aquila2-34B Benchmark Details

Aquila2-34B currently shows benchmark results led by C-Eval (22 / 48, score 63.07), GSM8K (37 / 68, score 58.40), MMLU (79 / 124, score 67.79).

Benchmark Results

Aquila2-34B

Benchmark Results

Thinking

Knowledge Exams

2 evaluations
Benchmark / mode
Score
Rank/total
MMLU
Standard Mode
67.79
79 / 124
C-Eval
Standard Mode
63.07
22 / 48

Mathematics

1 evaluations
Benchmark / mode
Score
Rank/total
GSM8K
Standard Mode
58.40
37 / 68

Code Generation & Editing

1 evaluations
Benchmark / mode
Score
Rank/total
HumanEval
Standard Mode
35.40
107 / 140