DataLearner logo

GPT-6 LunavsGPT-6 Sol

Across 4 shared benchmarks, GPT-6 Sol leads overall: GPT-6 Luna wins 0, GPT-6 Sol wins 4, with 0 ties and an average score difference of -6.58.

OpenAI
GPT-6 Luna

OpenAI · 2026-09-22 · Reasoning model

OpenAI
GPT-6 Sol

OpenAI · 2026-09-22 · Reasoning model

GPT-6 Luna0 wins(0%)(100%)4 winsGPT-6 Sol

Benchmark scores

Grouped by capability, sorted by largest gap within each. 4 shared benchmarks.

Coding and Software Engineer

GPT-6 Sol 2/2
BenchmarkGPT-6 LunaGPT-6 SolDiff
FrontierCode 1.1 Main42.409 / 9Max (With Tools)49.307 / 9Max (With Tools)-6.90
DeepSWE66.6037 / 91Max (With Tools)68.8025 / 91Max (With Tools)-2.20

Agent Level Benchmark

GPT-6 Sol 1/1
BenchmarkGPT-6 LunaGPT-6 SolDiff
Agents' Last Exam50.905 / 24Max (With Tools)56.402 / 24Max (With Tools)-5.50

AI Agent - Tool Usage

GPT-6 Sol 1/1
BenchmarkGPT-6 LunaGPT-6 SolDiff
OSWorld 2.052.7011 / 13Max (With Tools)64.407 / 13Max (With Tools)-11.70

Specs

FieldGPT-6 LunaGPT-6 Sol
PublisherOpenAIOpenAI
Release date2026-09-222026-09-22
Model typeReasoning modelReasoning model
ArchitectureDenseDense
ParametersNot availableNot available
Context length1.05M1.05M
Max output128K128K

API pricing

Prices use DataLearner records when available; missing fields are not inferred.

ItemGPT-6 LunaGPT-6 Sol
Text input$0.1 / 1M tokens$2 / 1M tokens
Text output$0.5 / 1M tokens$10 / 1M tokens
Cache read$0.01 / 1M tokens$0.2 / 1M tokens
Cache write$0.125 / 1M tokens$2.5 / 1M tokens

Summary

  • GPT-6 Solleads in:Coding and Software Engineer (2/2), Agent Level Benchmark (1/1), AI Agent - Tool Usage (1/1)

On average across the 4 shared benchmarks, GPT-6 Sol scores 6.58 higher.

Largest single-benchmark gap: OSWorld 2.0 — GPT-6 Luna 52.70 vs GPT-6 Sol 64.40 (-11.70).

Page generated from structured model, pricing and benchmark records. No real-time LLM is used to write the prose.