DataLearner logo

DeepSeek-R1-0528 Benchmark Details

DeepSeek-R1-0528 currently shows benchmark results led by MATH-500 (7 / 44, score 98), Creative Writing (4 / 23, score 86.25), MMLU Pro (26 / 132, score 85).

Benchmark Results

DeepSeek-R1-0528

Benchmark Results

Thinking

General Knowledge

5 evaluations
Benchmark / mode
Score
Rank/total
85
26 / 132
81
76 / 188
21.20
57 / 68
17.70
127 / 173
1.30
55 / 62

Common Sense

1 evaluations
Benchmark / mode
Score
Rank/total
27.80
27 / 47

Coding and Software Engineer

2 evaluations
Benchmark / mode
Score
Rank/total
73.30
46 / 123
57.60
85 / 113

Math and Reasoning

5 evaluations
Benchmark / mode
Score
Rank/total
98
7 / 44
91.40
13 / 62
87.50
45 / 107

Writing and Creative Capabilities

1 evaluations
Benchmark / mode
Score
Rank/total
86.25
4 / 23

AI Agent - Tool Usage

1 evaluations
Benchmark / mode
Score
Rank/total
5.70
35 / 35

Common Sense Reasoning

1 evaluations
Benchmark / mode
Score
Rank/total
Simple Bench
Thinking Enabled
40.80
38 / 63

Agent Level Benchmark

1 evaluations
Benchmark / mode
Score
Rank/total
Aider-Polyglot
Thinking Enabled
71.40
15 / 59