GPT-6 Sol 评测详情
GPT-6 Sol 当前已收录的代表性评测结果包括 CritPt(6 / 204,得分 30.86)、Agents' Last Exam(2 / 24,得分 56.40)、Code Migration(4 / 43,得分 57.20)。本页还提供与 2 个竞品模型及 3 个前代或同系列模型的对比,在有数据时会展示性能和价格视图。
评测结果
GPT-6 Sol
评测结果
程序生成与编辑
共 3 项评测评测名称 / 模式
得分
排名/总数
金融
共 3 项评测评测名称 / 模式
得分
排名/总数
医学知识与健康咨询
共 4 项评测评测名称 / 模式
得分
排名/总数
竞品对比
GPT-6 Sol 与同类主流模型的评测得分对比
评测类别:
柱状图按当前筛选范围内每个模型在各评测中的最高分展示;百分制评测使用原始高度,超出 0-100 的评测按该评测内相对比例缩放,标签仍保留原始分数。
12 项可对比评测得分汇总。每个模型展示最佳得分,模式在分数下方标注。
| 评测项 | GPT-6 Sol当前 | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|
73.10常规模式 | 83.60思考水平·高 | 88.40常规模式 | |
83.15思考水平·高 | 工具 | 87.42思考水平·高 | 工具 | 87.64思考水平·高 | 工具 | |
43.94思考水平·高 | 工具 | 58.18思考水平·高 | 工具 | 66.40思考水平·极高 | 工具 | |
68.80思考水平·高 | 工具 | 74.12思考水平·极高 | 工具 | -- | |
62.57常规模式 | 工具 | 66.61思考水平·高 | 工具 | 69.69常规模式 | 工具 | |
64.40思考水平·高 | 工具 | 72.60思考水平·高 | 工具 | 81.80思考水平·高 | 工具 | |
56.40思考水平·高 | 工具 | 59.30思考水平·高 | 工具 | -- | |
49.30思考水平·高 | 工具 | 53.30思考水平·高 | 工具 | 54.60思考水平·中 | 工具 | |
2.00思考水平·高 | 工具 | -- | 18.50思考水平·高 | 工具 | |
87.82思考水平·高 | 工具 | 89.59思考水平·高 | 工具 | 90.29思考水平·高 | 工具 | |
33.20思考水平·极高 | 工具 | 41.40思考水平·高 | 工具 | 40.00思考水平·高 | 工具 | |
30.86思考水平·高 | 31.70思考水平·高 | 31.71思考水平·高 |
其余 18 个 benchmark 仍可在上方图表中查看。
GPT-6 Sol 与同类模型的标准 API 价格对比
按模型并排展示标准文本输入价与输出价;若存在超长上下文加价,仅保留阈值内标准价,并在下方说明适用范围。
数据来源:DataLearnerAI,展示默认供应商的标准文本价格。 · USD / 1M tokens
若存在上下文阈值,图中标准价仅适用于以下范围:
GPT-6 Sol: 标准价适用于 <= 272000
GPT-6 Astra: 标准价适用于 <= 272000
| 模型 | 供应商 | 标准输入 | 标准输出 | 标准价适用于 |
|---|---|---|---|---|
GPT-6 Sol | OpenAI | $2 / 1M tokens | $10 / 1M tokens | <= 272000 |
GPT-6 Astra | OpenAI | $10 / 1M tokens | $50 / 1M tokens | <= 272000 |
Claude Opus 5.5 | Anthropic | $4 / 1M tokens | $20 / 1M tokens | — |
历代版本对比
GPT-6 Sol 系列各版本的评测成绩纵向对比
评测类别:
柱状图按当前筛选范围内每个模型在各评测中的最高分展示;百分制评测使用原始高度,超出 0-100 的评测按该评测内相对比例缩放,标签仍保留原始分数。
12 项可对比评测得分汇总。每个模型展示最佳得分,模式在分数下方标注。· 点击任意行可切换下方趋势图。
| 评测项 | GPT-6 Sol当前 | GPT-5.6 Sol | GPT-5.5 | GPT-5.4 |
|---|---|---|---|---|
73.10常规模式 | 64.80思考水平·极高 | 69.00常规模式 | -- | |
83.15思考水平·高 | 工具 | 88.80思考水平·高 | 83.10思考水平·极高 | 工具 | -- | |
43.94思考水平·高 | 工具 | 37.27思考水平·高 | 工具 | 14.60思考水平·极高 | 工具 | -- | |
68.80思考水平·高 | 工具 | 72.70思考水平·极高 | 工具 | 67.04思考水平·极高 | 工具 | 51.77思考水平·极高 | 工具 | |
62.57常规模式 | 工具 | 72.63思考水平·极高 | 57.41思考水平·极高 | 工具 | -- | |
64.40思考水平·高 | 工具 | 65.70思考水平·高 | -- | -- | |
56.40思考水平·高 | 工具 | 53.60思考水平·高 | -- | -- | |
49.30思考水平·高 | 工具 | 47.50思考水平·高 | -- | -- | |
2.00思考水平·高 | 工具 | 23.00思考水平·高 | 工具 | -- | -- | |
87.82思考水平·高 | 工具 | 80.50思考水平·高 | 工具 | 69.85思考水平·极高 | 工具 | 48.47思考水平·极高 | 工具 | |
33.20思考水平·极高 | 工具 | 45.80思考水平·高 | 工具 | -- | -- | |
30.86思考水平·高 | 32.30思考水平·高 | 27.10思考水平·极高 | 23.40思考水平·极高 |
其余 17 个 benchmark 仍可在上方图表中查看。
单评测历史趋势图
当前查看:SimpleBench · 常识推理
选择评测
GPT-6 Sol 所在系列的标准 API 价格对比
按模型并排展示标准文本输入价与输出价;若存在超长上下文加价,仅保留阈值内标准价,并在下方说明适用范围。
数据来源:DataLearnerAI,展示默认供应商的标准文本价格。 · USD / 1M tokens
若存在上下文阈值,图中标准价仅适用于以下范围:
GPT-6 Sol: 标准价适用于 <= 272000
| 模型 | 供应商 | 标准输入 | 标准输出 | 标准价适用于 |
|---|---|---|---|---|
GPT-6 Sol | OpenAI | $2 / 1M tokens | $10 / 1M tokens | <= 272000 |
GPT-5.6 Sol | OpenAI | $4 / 1M tokens | $20 / 1M tokens | — |
GPT-5.5 | OpenAI | $5 / 1M tokens | $30 / 1M tokens | — |
GPT-5.4 | OpenAI | $2.5 / 1M tokens | $15 / 1M tokens | — |

