DataLearner logo

SWE-2 Benchmark Details

SWE-2 currently shows benchmark results led by Terminal-Bench 2.1 (1 / 193, score 92.80), Terminal-Bench 4.0 (20 / 87, score 27.30), FrontierCode 1.1 Main (4 / 5, score 50).

Benchmark Results

SWE-2

Benchmark Results

Thinking

AI Agent - Tool Usage

2 evaluations
Benchmark / mode
Score
Rank/total
92.80
1 / 193
27.30
20 / 87

Coding and Software Engineer

1 evaluations
Benchmark / mode
Score
Rank/total
50
4 / 5