See key specs and per-benchmark scores for each model/mode. Scroll horizontally for all columns. 当前对比 2 个模型的评测数据与核心参数。

GPT-5.6 Sol
OpenAI

Best overall
GPT-5.6 Sol · 69.20
Best single
GPT-5.6 Sol · TerminalBench 2.1 88.80
Modality coverage
Kimi K3 · 3 modalities
Head to head
4
Benchmarks
4
Wins
0
Losses
+8.60
Average diff
Compare benchmark results across thinking modes and tool usage.
Data sourced primarily from official releases (GitHub, Hugging Face, papers), then benchmark leaderboards, then third-party evaluators. Learn about our data methodology
Complete scores for each model/mode across selected benchmarks.
4 benchmarks with comparable scores. Each model shows its best score; mode label is displayed below.
| Benchmark | GPT-5.6 Sol | Kimi K3 |
|---|---|---|
DeepSWE 编程与软件工程 | 72.70Thinking Level · Extra High | Tools | 67.50Thinking Level · High | Tools |
Agents' Last Exam AI Agent - 工具使用 | 52.70Thinking Level · Extra High | Tools | 28.30Thinking Level · High | Tools |
OSWorld 2.0 AI Agent - 工具使用 | 62.60Thinking Level · Extra High | Tools | 58.30Thinking Level · High | Tools |
TerminalBench 2.1 AI Agent - 工具使用 | 88.80Thinking Level · High | 88.30Thinking Level · High | Tools |
Side-by-side input/output token pricing
Licensing, MoE architecture, and multi-modality support.
| Features & specs | GPT-5.6 SolOpenAI | Kimi K3Moonshot AI |
|---|---|---|
Core specsRelease | 2026-06-26 | 2026-07-16 |
Context length | 1.05M | 1M |
Parameters | — | 28000 |
Active parameters | Not provided | 1040 |
Max output | 128000 | 1048576 |
MoE | No | Yes |
LicenseCode Open Source | Not provided | Not provided |
Weights Open Source | Not provided | Not provided |
Commercial use | 不开源 | 有条件免费商用授权 |
Modality supportText Input/Output | / | / |
Image Input/Output | / | / |
Video Input/Output | Not provided | / |
ResourcesPaper / report | Previewing GPT-5.6 Sol: a next-generation model | Kimi K3 技术报告 |
Kimi K3
Moonshot AI