Claude Sonnet 3.7 Benchmark Details
Claude Sonnet 3.7 currently shows benchmark results led by Aider-Polyglot (18 / 59, score 64.90), MMMU (33 / 74, score 75), SWE-bench Verified (61 / 116, score 70.30). 1 source link is attached for reference.
Benchmark Results
Claude Sonnet 3.7
Benchmark Results
Scientific Reasoning
3 evaluationsBenchmark / mode
Score
Rank/total
Repository Engineering
2 evaluationsBenchmark / mode
Score
Rank/total
Mathematics
5 evaluationsBenchmark / mode
Score
Rank/total
Visual Understanding
5 evaluationsBenchmark / mode
Score
Rank/total
Commonsense
2 evaluationsBenchmark / mode
Score
Rank/total
Agentic Development
4 evaluationsBenchmark / mode
Score
Rank/total
Service Workflows
2 evaluationsBenchmark / mode
Score
Rank/total
Capability Frontier Metrics
2 evaluationsBenchmark / mode
Score
Rank/total