DataLearner 标志

GPT-6 LunavsClaude Sonnet 5

在 3 个共同 benchmark 中,GPT-6 Luna 整体领先:GPT-6 Luna 领先 2 项,Claude Sonnet 5 领先 1 项,持平 0 项,平均分差 -16.21。

OpenAI
GPT-6 Luna

OpenAI · 2026-09-22 · 推理大模型

Anthropic
Claude Sonnet 5

Anthropic · 2026-06-30 · 多模态大模型

GPT-6 Luna2 (67%)(33%)1 Claude Sonnet 5

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

AI Agent - Tool Usage

GPT-6 Luna 领先 1/1
评测项GPT-6 LunaClaude Sonnet 5分差
Terminal-Bench 4.01348 / 95Max (With Tools)12.4252 / 95Max (With Tools)+0.58

Multimodal Understanding

GPT-6 Luna 领先 1/1
评测项GPT-6 LunaClaude Sonnet 5分差
GDP.pdf2040 / 122Max (No Tools)13.2068 / 122Max (No Tools)+6.80

Productivity Knowledge

Claude Sonnet 5 领先 1/1
评测项GPT-6 LunaClaude Sonnet 5分差
AA-Briefcase1,29938 / 88Max (With Tools)1,35532 / 88Max (With Tools)-56

规格对比

字段GPT-6 LunaClaude Sonnet 5
发布机构OpenAIAnthropic
发布时间2026-09-222026-06-30
模型类型推理大模型多模态大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度1.05M1M
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-6 LunaClaude Sonnet 5
文本输入$0.1 / 1M tokens$2 / 1M tokens
文本输出$0.5 / 1M tokens$10 / 1M tokens
缓存读取$0.01 / 1M tokens$0.2 / 1M tokens
缓存写入$0.125 / 1M tokens$2.5 / 1M tokens

小结

  • GPT-6 Luna在以下类目领先:AI Agent - Tool Usage (1/1)、Multimodal Understanding (1/1)
  • Claude Sonnet 5在以下类目领先:Productivity Knowledge (1/1)

3 个共同 benchmark 上,Claude Sonnet 5 平均高出 16.21 分。

单项差距最大的 benchmark:AA-Briefcase — GPT-6 Luna 1,299,Claude Sonnet 5 1,355(分差 -56)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。