DataLearner 标志

GPT-5.5 ProvsGPT-5.4 Pro

在 5 个共同 benchmark 中,GPT-5.5 Pro 整体领先:GPT-5.5 Pro 领先 4 项,GPT-5.4 Pro 领先 1 项,持平 0 项,平均分差 +5.34。

OpenAI
GPT-5.5 Pro

OpenAI · 2026-04-23 · 推理大模型

OpenAI
GPT-5.4 Pro

OpenAI · 2026-03-05 · 多模态大模型

GPT-5.5 Pro4 (80%)(20%)1 GPT-5.4 Pro

评测分数

按能力类目分组,每组内按分差大小排列;共 5 项。

General Knowledge

GPT-5.5 Pro 领先 2/2
评测项GPT-5.5 ProGPT-5.4 Pro分差
ARC-AGI-196.5015 / 147Thinking High (No Tools)94.5026 / 147Thinking High (No Tools)+2
CritPt30.605 / 200Extra-High (No Tools)307 / 200Extra-High (No Tools)+0.60

Math and Reasoning

GPT-5.5 Pro 领先 2/2
评测项GPT-5.5 ProGPT-5.4 Pro分差
FrontierMath Tier 4 v278.055 / 42Extra-High (No Tools)58.5410 / 42Extra-High (No Tools)+19.51
FrontierMath v287.722 / 58Extra-High (No Tools)82.467 / 58Extra-High (No Tools)+5.26

科学与综合推理

GPT-5.4 Pro 领先 1/1
评测项GPT-5.5 ProGPT-5.4 Pro分差
GPQA Diamond93.9218 / 462Extra-High (No Tools)94.606 / 462Extra-High (No Tools)-0.68

规格对比

字段GPT-5.5 ProGPT-5.4 Pro
发布机构OpenAIOpenAI
发布时间2026-04-232026-03-05
模型类型推理大模型多模态大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度1000K1M
最大输出128K125K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-5.5 ProGPT-5.4 Pro
文本输入$30 / 1M tokens$30 / 1M tokens
文本输出$180 / 1M tokens$180 / 1M tokens

小结

  • GPT-5.5 Pro在以下类目领先:General Knowledge (2/2)、Math and Reasoning (2/2)
  • GPT-5.4 Pro在以下类目领先:科学与综合推理 (1/1)

5 个共同 benchmark 上,GPT-5.5 Pro 平均高出 5.34 分。

单项差距最大的 benchmark:FrontierMath Tier 4 v2 — GPT-5.5 Pro 78.05,GPT-5.4 Pro 58.54(分差 +19.51)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。