OpenAI 于 2026 年 6 月 26 日以限定预览形式发布的 GPT-5.6 系列轻量模型,面向更快、更低成本的日常任务(摘要、起草、常规自动化),是三款模型中速度最快、价格最低的一款。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
模型基本信息
开源和体验地址
官方介绍与博客
API接口信息
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $1.00/ 1M | $6.00/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | context_tokens > 272000 | $2.00/ 1M | $9.00/ 1M |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | 30m | $1.25/ 1M | $0.100/ 1M |
评测结果
GPT-5.6 Luna 当前已收录的代表性评测结果包括 TerminalBench 2.1(6 / 25,得分 84.70)、ARC-AGI-3(2 / 8,得分 0.20)、ARC-AGI(18 / 67,得分 88)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
综合评估
共 4 项评测和其他模型对比
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
发布机构
模型解读
GPT-5.6 Luna
GPT-5.6 Luna 是 OpenAI 于 2026 年 6 月 26 日限定预览、7 月 9 日正式全面开放的 GPT-5.6 系列高性价比模型,面向成本敏感、高吞吐的日常任务(摘要、起草、常规自动化),是三款模型中速度最快、价格最低的一款。系列同时包含旗舰版 Sol 与均衡版 Terra。
在 Artificial Analysis Intelligence Index(max 推理档位)中,Luna 得分 51,每任务成本约 $0.21,约为 Sol 的五分之一,性价比约每美元 24 个基准分。Terminal-Bench 2.1 得分 84.70,DeepSWE 得分 67.20,AA Coding Agent Index 得分 74.6,Agents' Last Exam 得分 50.3。长上下文召回相对偏弱(MRCR 41.3%),更适合较短、范围明确的任务,不建议用于大文档长链路工作流。
Luna 与 Sol、Terra 共享同一份 OpenAI GPT-5.6 system card 安全评估,网络安全与生物/化学风险两项能力评级均为「High」;详细披露内容参见 GPT-5.6 Sol 页面。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
