DataLearner logo

Qwen3-Coder-Next Benchmark Details

Qwen3-Coder-Next currently shows benchmark results led by SWE-bench Verified (59 / 116, score 70.60), Terminal Bench Hard (154 / 244, score 18.20), Pinch Bench (26 / 38, score 79.10).

Benchmark Results

Qwen3-Coder-Next

Benchmark Results

Thinking
Tool usage

Repository Engineering

2 evaluations
Benchmark / mode
Score
Rank/total
SWE-bench Verified
Standard ModeTools
70.60
59 / 116
SWE-Bench Pro - Public
Standard ModeTools
44.30
53 / 62

Agentic Development

2 evaluations
Benchmark / mode
Score
Rank/total
Terminal Bench 2.0
Standard ModeTools
36.20
47 / 48
Terminal Bench Hard
Standard ModeTools
18.20
154 / 244

Tool Orchestration

2 evaluations
Benchmark / mode
Score
Rank/total
Pinch Bench
Thinking ModeTools
79.10
26 / 38
Claw Bench
Thinking ModeTools
75.80
24 / 29

Scientific Computing

1 evaluations
Benchmark / mode
Score
Rank/total
SciCode
Standard Mode
36.20
118 / 134

Service Workflows

1 evaluations
Benchmark / mode
Score
Rank/total
τ³-Banking
Standard ModeTools
5.40
152 / 167

Documents & Charts

1 evaluations
Benchmark / mode
Score
Rank/total
GDP.pdf
Standard Mode
2.60
108 / 122