DataLearner 标志

GPT-5.4 minivsGPT-5-mini

在 9 个共同 benchmark 中,GPT-5.4 mini 整体领先:GPT-5.4 mini 领先 5 项,GPT-5-mini 领先 4 项,持平 0 项,平均分差 +42.09。

OpenAI
GPT-5.4 mini

OpenAI · 2026-03-17 · 推理大模型

OpenAI
GPT-5-mini

OpenAI · 2025-08-07 · 基础大模型

GPT-5.4 mini5 (56%)(44%)4 GPT-5-mini

评测分数

按能力类目分组,每组内按分差大小排列;共 9 项。

Agent Level Benchmark

胶着 2/2
评测项GPT-5.4 miniGPT-5-mini分差
τ²-Bench - Telecom23.40234 / 264Normal (With Tools)31.90206 / 264Normal (With Tools)-8.50
Terminal Bench Hard18.20154 / 244Normal (With Tools)14.40170 / 244Normal (With Tools)+3.80

General Knowledge

胶着 2/2
评测项GPT-5.4 miniGPT-5-mini分差
LiveBench36.95114 / 117Normal (No Tools)61.0168 / 117Normal (No Tools)-24.06
HLE5.90462 / 563Normal (No Tools) · Text only5.10478 / 563Normal (No Tools) · Text only+0.80

Instruction Following

GPT-5-mini 领先 1/1
评测项GPT-5.4 miniGPT-5-mini分差
IF Bench38.80225 / 282Normal (No Tools)45.60178 / 282Normal (No Tools)-6.80

Math and Reasoning

GPT-5-mini 领先 1/1
评测项GPT-5.4 miniGPT-5-mini分差
FrontierMath - Tier 42.1056 / 80Thinking High (No Tools)6.3035 / 80Thinking High (No Tools)-4.20

Multimodal Understanding

GPT-5.4 mini 领先 1/1
评测项GPT-5.4 miniGPT-5-mini分差
MMMU-Pro60.50172 / 227Normal (No Tools)58.40180 / 227Normal (No Tools)+2.10

Writing and Creative Capabilities

GPT-5.4 mini 领先 1/1
评测项GPT-5.4 miniGPT-5-mini分差
Creative Writing1,66234 / 106Normal (No Tools)1,31072 / 106Normal (No Tools)+351.50

科学与综合推理

GPT-5.4 mini 领先 1/1
评测项GPT-5.4 miniGPT-5-mini分差
GPQA Diamond64.14362 / 462Normal (No Tools)0461 / 462Normal (No Tools)+64.14

规格对比

字段GPT-5.4 miniGPT-5-mini
发布机构OpenAIOpenAI
发布时间2026-03-172025-08-07
模型类型推理大模型基础大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度400K400K
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-5.4 miniGPT-5-mini
文本输入$0.75 / 1M tokens$0.25 / 1M tokens
文本输出$4.5 / 1M tokens$2 / 1M tokens
缓存读取$0.075 / 1M tokens$0.025 / 1M tokens
缓存写入暂无公开价格$0 / 1M tokens

小结

  • GPT-5.4 mini在以下类目领先:Multimodal Understanding (1/1)、Writing and Creative Capabilities (1/1)、科学与综合推理 (1/1)
  • GPT-5-mini在以下类目领先:Instruction Following (1/1)、Math and Reasoning (1/1)
  • 胶着类目:Agent Level Benchmark、General Knowledge

9 个共同 benchmark 上,GPT-5.4 mini 平均高出 42.09 分。

单项差距最大的 benchmark:Creative Writing — GPT-5.4 mini 1,662,GPT-5-mini 1,310(分差 +351.50)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。