DataLearner 标志
GP

GPT-6 Astra

预览版推理大模型编程大模型GPT

OpenAI GPT-6 Astra

别名:GPT-6 / GPT Astra / OpenAI Astra / Astra

发布时间: 2026-09-03更新于: 2026-09-04知识截止: 2026-04-30浏览量: 377
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1.05M
多语言支持
支持
推理能力
5/5

OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra,定位为面向复杂推理、编程、计算机操作、研究与文档工作的旗舰模型。官方 API 标识为 gpt-6-astra,支持 105 万 token 上下文、12.8 万 token 最大输出、文本与图像输入,以及 low、medium、high、xhigh、max 五档推理强度。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT-6 Astra

模型基本信息

推理过程
支持
思考模式
思考水平 · 中 (Medium) (默认)思考水平 · 低 (Low)思考水平 · 高 (High)思考水平 · 极高 (Extra-High)思考水平 · 最高 (Max)
上下文长度
1.05M tokens
最大输出长度
128K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-09-03
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
2026-04-30
GPT-6 Astra

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
GPT-6 Astra

官方介绍与博客

DataLearnerAI博客
暂无
GPT-6 Astra

API接口信息

接口速度
4/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本上下文长度 <= 272000$10.00/ 1M$50.00/ 1M
文本上下文长度 > 272000$20.00/ 1M$75.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本-$12.50/ 1M
上下文长度 <= 272000
$1.00/ 1M
上下文长度 <= 272000
文本-$25.00/ 1M
上下文长度 > 272000
$2.00/ 1M
上下文长度 > 272000

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

GPT-6 Astra

评测结果

GPT-6 Astra 当前已收录的代表性评测结果包括 GPQA Diamond(1 / 271,得分 96)、ARC-AGI-1(1 / 91,得分 98.50)、ARC-AGI-2(1 / 85,得分 95)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合评估

共 8 项评测
评测名称 / 模式
得分
排名/总数
ARC-AGI-1
常规模式
98.50
1 / 91
ARC-AGI-2
常规模式
95
1 / 85
ARC-AGI-3
常规模式
62.70
1 / 16
61.20
7 / 28
HLE
常规模式
57.20
12 / 190
2.40
1 / 1
Circumvention
常规模式
0
1 / 1

科学与综合推理

共 5 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
96
1 / 271
LifeSciBench
常规模式
60.30
1 / 1
49.30
1 / 1
GeneBench Pro
常规模式
37.80
1 / 1

AI Agent - 信息收集

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
常规模式
91.50
1 / 56

编程与软件工程

共 7 项评测
评测名称 / 模式
得分
排名/总数
88
1 / 1
SEC-Bench Pro
常规模式
85.40
1 / 1
DeepSWE
常规模式
74.10
2 / 35
67
4 / 4
FrontierCode 1.1
常规模式
64.50
1 / 6
63.90
1 / 1
53.30
1 / 1

AI Agent - 工具使用

共 10 项评测
评测名称 / 模式
得分
排名/总数
ExploitBench
常规模式
100
1 / 2
100
1 / 1
92.70
1 / 1
OSWorld 2.0
常规模式
72.60
2 / 9
64.60
1 / 11
Terminal-Bench 4.0
常规模式
57.90
1 / 13
42.40
1 / 1
AutomationBench
常规模式
41.40
5 / 14
0
1 / 1

Agent能力评测

共 1 项评测
评测名称 / 模式
得分
排名/总数
Agents' Last Exam
常规模式
59.30
1 / 15

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
97.60
1 / 41

生产力知识

共 3 项评测
评测名称 / 模式
得分
排名/总数
BenchCAD
常规模式
95.90
1 / 1
50
1 / 1
40.90
1 / 1

写作和创作

共 1 项评测
评测名称 / 模式
得分
排名/总数
0.84
1 / 1

真实性评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
Hallucination rate
常规模式
4.20
1 / 1

长上下文

共 2 项评测
评测名称 / 模式
得分
排名/总数

和其他模型对比

GPT-6 Astra

发布机构

OpenAI GPT-6 Astra

模型解读

GPT-6 正式型号:GPT-6 Astra

GPT-6 Astra 是 OpenAI 于 2026 年 9 月 3 日发布的旗舰推理模型,官方 API 模型 ID 为 gpt-6-astra。它面向复杂推理、软件工程、计算机操作、研究与文档创建,并强调把多步骤工作从初始请求推进到完整结果。此前站内分别收录的 GPT-6 与 Astra 传闻现已由官方名称统一确认;本页是两者的正式归一化记录。

规格与模态

  • 上下文窗口:1,050,000 tokens
  • 最大输出:128,000 tokens
  • 知识截止:2026 年 4 月 30 日
  • 输入:文本、图像
  • 输出:文本
  • 推理强度:low、medium、high、xhigh、max;不支持 none

OpenAI 没有公开参数总量、激活参数或模型架构,因此这些字段继续留空。官方仅确认其具备多语言能力,没有给出可核验的语种数量或完整 BCP-47 清单。

Agent 与工具能力

GPT-6 Astra 支持流式输出、函数调用、结构化输出,以及 Responses API 中的 Web search、File search、Image generation、Code interpreter、Hosted shell、Apply patch、Skills、Computer use、MCP 与 Tool search。新能力包括异步工具调用、WebSocket 中途指令调整,以及在不中断提示缓存前缀的情况下用 configuration_update 调整后续轮次的推理强度。虽然模型也支持 Chat Completions,但工具调用需要 Responses API。

价格

标准短上下文价格为每百万 tokens:输入 10 美元、缓存读取 1 美元、缓存写入 12.50 美元、输出 50 美元。当单次请求的输入超过 272K tokens 时,整次请求按长上下文费率计价:输入 20 美元、缓存读取 2 美元、缓存写入 25 美元、输出 75 美元。Batch 与 Flex 为 Standard 的 50%,Fast mode 为适用费率的 2 倍。区域处理可能另有 10% 加价。

访问状态

OpenAI 的发布说明称,模型先向 Trusted Access Program 企业客户推出,API 以及 ChatGPT Plus、Pro、Business、Enterprise 方案将在随后数日逐步开放。由于发布首日仍处于分阶段放量,本页暂标记为 Preview,待官方确认全面开放后再升级为 GA。

迁移注意事项

从旧型号迁移时,应把 API 模型名改为 gpt-6-astra。原先使用 none 或 minimal 推理强度的请求应从 low 开始测试;模型不接受自定义 temperaturetop_ptop_logprobs,Chat Completions 也不接受 logprobs。需要工具调用时应改用 Responses API。EU 数据驻留场景不能使用 Fast mode,且 Fast mode 没有延迟 SLA。

官方评测

OpenAI 在 GPT-6 Astra 发布页末尾公开了 9 类、40 条评测结果,覆盖计算机操作、专业工作、编程、学术、科学与健康、网络安全、对齐、长上下文和抽象推理。本站已按发布页逐项录入,并保留 OSWorld 2.0 offline partial、ScreenSpot-Pro no-tools、HLE with tools、HealthBench Professional length-adjusted、两个 MRCR 区间等测试条件。ARC-AGI-3 一项本站采用 ARC Prize 官方复核的 62.7%(Semi-Private 半私有集、Standard harness、max effort、成本 26,098 美元),而非 OpenAI 发布页引用的 99.9%。后者出自 OpenAI 自建的 Provider Adapter harness(high effort、成本 18,817 美元),该脚手架会在多次请求之间保留不透明的推理状态,与其它厂商的成绩不可横向比较;两个数字均为该基准的最高水平,本站在榜单中只保留可比口径的那一个。官方说明这些数值取各 effort 设置中的最高结果,运行环境可能是 OpenAI research environment 或 API,因此统一标记为“模式未注明”,不能概括成单一 max 档位。计算机操作安全、AutoReview、circumvention、ExploitGym honeypot 和 hallucination 五项为数值越低越好。

官方来源

GPT-6 Astra

常见问题

GPT-6 和 Astra 是两个不同模型吗?

不是。OpenAI 的正式产品名是 GPT-6 Astra,API 标识为 gpt-6-astra。DataLearner 过去的 GPT-6 与 Astra 传闻条目已归一化为同一正式型号,旧地址会跳转到本页。

GPT-6 Astra 什么时候发布?

OpenAI API 更新日志记录的发布日期是 2026 年 9 月 3 日。首批向 Trusted Access Program 企业客户开放,API 与 ChatGPT Plus、Pro、Business、Enterprise 用户在随后数日分批获得访问权限。

GPT-6 Astra 的上下文窗口和最大输出是多少?

官方模型页给出的上下文窗口是 1,050,000 tokens,最大输出是 128,000 tokens,知识截止日期为 2026 年 4 月 30 日。

GPT-6 Astra 的 API 价格是多少?

标准短上下文每百万 tokens 输入 10 美元、缓存输入 1 美元、缓存写入 12.50 美元、输出 50 美元。输入超过 272K tokens 时,整次请求分别按 20、2、25、75 美元计价。Batch 和 Flex 为标准价的一半,Fast mode 为适用费率的两倍。

GPT-6 Astra 支持哪些推理强度?

支持 low、medium、high、xhigh 和 max,不支持 none。迁移时若原请求使用 none 或 minimal,OpenAI 建议从 low 开始测试。

GPT-6 Astra 支持哪些输入和工具?

支持文本和图像输入、文本输出,并支持流式输出、函数调用、结构化输出、Web search、File search、Image generation、Code interpreter、Hosted shell、Apply patch、Skills、Computer use、MCP 和 Tool search。工具调用需要 Responses API。

GPT-6 Astra 的参数量和官方 benchmark 分数是多少?

OpenAI 尚未公开参数总量或激活参数。发布页已公开 9 类、40 条官方评测结果,本站已逐项收录;成绩是各 effort 设置中的最高值,不能统一解读为 max 档位,其中五项安全与幻觉率指标为数值越低越好。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码