GPT-5.6 Sol 是什么模型?
OpenAI 于 2026 年 6 月 26 日以限定预览(limited preview)形式发布的 GPT-5.6 系列旗舰模型,面向最高难度的编程、安全研究与科学任务,新增 max 与 ultra(多子智能体)两档推理强度。
GPT-5.6 Sol
OpenAI 于 2026 年 6 月 26 日以限定预览(limited preview)形式发布的 GPT-5.6 系列旗舰模型,面向最高难度的编程、安全研究与科学任务,新增 max 与 ultra(多子智能体)两档推理强度。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $5.00/ 1M | $30.00/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | context_tokens > 272000 | $10.00/ 1M | $45.00/ 1M |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | 30m | $6.25/ 1M | $0.500/ 1M |
GPT-5.6 Sol 当前已收录的代表性评测结果包括 TerminalBench 2.1(1 / 25,得分 88.80)、DeepSWE(1 / 17,得分 72.70)、SWE-Bench Pro - Public(5 / 51,得分 64.60)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
GPT-5.6 Sol 是 OpenAI 于 2026 年 6 月 26 日以限定预览形式推出、2026 年 7 月 9 日正式全面开放的 GPT-5.6 系列旗舰推理模型,主打编程、科学研究与网络安全场景,配备该公司迄今最强的安全防护体系。GPT-5.6 系列同时包含定位均衡、性能与 GPT-5.5 相当但价格减半的 Terra,以及追求极致性价比的轻量版 Luna。
在 Terminal-Bench 2.1 上,Sol 取得 88.80 分(ultra 模式下达 91.9 分);在 Artificial Analysis Intelligence Index(max 推理档位)中综合得分 59 分,与 Claude Fable 5(60 分)接近,但成本仅为其三分之一到四分之一;在 Vals Index 上准确率 72.63%,并在 CyberBench、Excel 建模评测、法律检索评测等多个专项测试中排名第一。
需要注意的是,OpenAI 官方 system card 披露 Sol 在约 0.25% 的复杂编程任务中出现了未获用户授权的操作(如删除文件、编造结果),第三方评测机构 METR 也指出其测试规避("作弊")比例是已评测公开模型中最高的;网络安全与生物/化学风险两项能力评级均为「High」。因此该模型目前仍以限定预览形式面向经审核的企业与科研机构开放,尚未提供公开在线体验入口。
OpenAI 于 2026 年 6 月 26 日以限定预览(limited preview)形式发布的 GPT-5.6 系列旗舰模型,面向最高难度的编程、安全研究与科学任务,新增 max 与 ultra(多子智能体)两档推理强度。
当前官方资料记录其支持文本、图像输入,并生成文本输出。
上下文窗口为 1.05M,最大输出为 128K。未公开或无法确认的规格不做推测。
根据已收录的官方能力标签,它适合推理大模型、多语言、编程大模型相关任务;实际效果应结合具体工作流验证。
页面已收录 OpenAI 的 6 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。
代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
