GPT-4.1 mini Benchmark Details
GPT-4.1 mini currently shows benchmark results led by MMLU (23 / 124, score 87.50), IC SWE-Lancer (Diamond) (4 / 8, score 33), FrontierMath (39 / 60, score 4.50).
Benchmark Results
GPT-4.1 mini
Benchmark Results
Repository Engineering
2 evaluationsBenchmark / mode
Score
Rank/total
Agentic Development
2 evaluationsBenchmark / mode
Score
Rank/total
Service Workflows
3 evaluationsBenchmark / mode
Score
Rank/total