DataLearner logo

GPT-4o(2025-03-27) Benchmark Details

GPT-4o(2025-03-27) currently shows benchmark results led by SimpleQA (20 / 47, score 40.30), Creative Writing (10 / 23, score 84.90), MMLU Pro (64 / 132, score 79.80).

Benchmark Results

GPT-4o(2025-03-27)

Benchmark Results

Thinking

General Knowledge

3 evaluations
Benchmark / mode
Score
Rank/total
79.80
64 / 132
66.90
130 / 187
8.80
63 / 68

Common Sense

1 evaluations
Benchmark / mode
Score
Rank/total
40.30
20 / 47

Coding and Software Engineer

1 evaluations
Benchmark / mode
Score
Rank/total
35.80
107 / 123

Math and Reasoning

1 evaluations
Benchmark / mode
Score
Rank/total
26.70
102 / 107

Writing and Creative Capabilities

1 evaluations
Benchmark / mode
Score
Rank/total
84.90
10 / 23

Agent Level Benchmark

1 evaluations
Benchmark / mode
Score
Rank/total
Aider-Polyglot
Standard Mode
45.30
36 / 59
GPT-4o(2025-03-27) Benchmark Results & Rankings | DataLearnerAI