DataLearner 标志
GP

GPT-Live-1

语音大模型实时对话大模型ChatGPT

GPT-Live-1

发布时间: 2026-07-08更新于: 2026-08-22 23:28:49.173133
在线体验GitHubHugging FaceCompare
模型参数
未披露
上下文长度
暂无数据
中文支持
不支持
推理能力

GPT-Live-1 是 OpenAI 于 2026 年 7 月 8 日发布的新一代 ChatGPT Voice 模型,采用 full-duplex 架构,可同时听和说,支持更自然的打断、停顿和连续对话;它将成为 Go、Plus、Pro 等付费用户的默认 Live 语音模型,并可在需要时委派 GPT-5.5 处理搜索、推理和复杂任务。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT-Live-1

模型基本信息

推理过程
支持
思考模式
思考水平 · 低 (Low) (默认)常规模式思考水平 · 中 (Medium)思考水平 · 高 (High)
上下文长度
暂无数据
最大输出长度
暂无数据
模型类型
语音大模型
输入/输出模态
文本、图像、音频 → 文本、音频
发布时间
2026-07-08
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不涉及
知识截止
暂无数据
GPT-Live-1

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无GitHub开源地址
Hugging Face
暂无开源HuggingFace地址
GPT-Live-1

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
GPT-Live-1

API接口信息

接口速度
5/5
暂无公开的 API 定价信息。
GPT-Live-1

评测结果

GPT-Live-1 当前已收录的代表性评测结果包括 GPQA(3 / 16,得分 84.20)、BrowseComp(26 / 54,得分 75.20)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA
84.20
3 / 16

AI Agent - 信息收集

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
工具联网
75.20
26 / 54

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

GPT-Live-1

发布机构

GPT-Live-1

模型解读

2026年7月8日,OpenAI 发布 GPT-Live,并开始向 ChatGPT 用户推出两个版本:GPT-Live-1GPT-Live-1 mini。GPT-Live-1 是面向 Go、Plus、Pro 等付费用户的默认 ChatGPT Voice Live 模型,官方定位为新一代自然人机语音交互模型。


Full-duplex 语音交互

GPT-Live-1 基于 full-duplex 架构,可以持续处理输入并同时生成输出,而不是等待一个明确的语音回合结束后才响应。OpenAI 表示,这让模型能够跟随停顿、打断和语速变化,在对话中决定是回应、继续听、暂停、插话还是调用工具,因此语音体验更接近自然对话。

在 ChatGPT Voice 中,GPT-Live-1 可以边听边说,支持更自然的轮换和打断;它也能在合适时保持安静,或用简短回应表示正在倾听。OpenAI 还为 GPT-Live 重新调校了 ChatGPT 中的预设语音。


复杂任务委派与智能等级

GPT-Live-1 主要负责连续语音交互和实时对话流。当问题需要网页搜索、更深推理或更复杂的工作时,它可以把任务委派给后台的前沿模型并把结果带回语音对话。OpenAI 在发布时说明,GPT-Live 启动阶段后台使用 GPT-5.5;GPT-Live-1 instant 和 GPT-Live-1 mini 使用 GPT-5.5 Instant,GPT-Live-1 Medium 和 GPT-Live-1 High 使用 GPT-5.5 Thinking 的 medium/high reasoning effort。

ChatGPT 帮助中心说明,Live 语音可使用 web search 和 memory,能显示受支持的小组件视觉结果,并可在同一聊天中处理文本和图片。Live 初始不支持视频、屏幕共享、连接应用或插件。


可用范围

GPT-Live-1 正在全球范围内向 ChatGPT consumer plans 推出,可在 ChatGPT iOS、Android 和网页端使用。发布时它不适用于 ChatGPT Business、Enterprise 或 Edu 工作区,也不适用于 Temporary Chats、ChatGPT 桌面应用、Work、Codex 或自定义 GPTs。OpenAI 表示未来计划将 GPT-Live 带到 API,但发布时尚未公开 API 模型名、价格表、上下文长度、最大输出或知识截止时间。


评估与安全

OpenAI 的发布页称,GPT-Live-1 和 GPT-Live-1 mini 在 5-10 分钟匹配对话的人类偏好评估中,相比 Advanced Voice Mode 在总体偏好、轮换、打断、对话流和自然度上更受偏好;GPT-Live-1 在 GPQA 和 BrowseComp 上相对 Advanced Voice Mode 有提升。官方系统卡还说明,GPT-Live-1 与 GPT-Live-1 mini 接入了与文本模型相当的安全栈,并增加了面向语音模态的运行时安全处理,包括对输入和输出进行对话中检查,在高风险情况下可中断回复、播放语音安全提示或结束语音会话。公开转写的 OpenAI 图表数值显示,GPT-Live-1 High 在 GPQA 上为 84.2,在 BrowseComp 上为 75.2;本条目已按 GPQA High(无工具)和 BrowseComp High(工具+联网)录入评测成绩。

GPT-Live-1

常见问题

GPT-Live-1 为什么听起来比以前的语音模式自然?

关键在 full-duplex 架构:模型可以持续处理输入并同时生成输出,而不是等待一个明确的语音回合结束才响应。它能在对话中实时决定是回应、继续听、暂停、插话还是调用工具,也能在合适时保持安静或用简短回应表示正在倾听。OpenAI 还为 GPT-Live 重新调校了 ChatGPT 中的预设语音。

GPT-Live-1 遇到复杂问题怎么处理?

委派给后台的前沿模型再把结果带回语音对话。它自己主要负责连续语音交互和实时对话流;当问题需要网页搜索、更深推理或更复杂的工作时会转交后台处理。发布阶段后台使用 GPT-5.5——GPT-Live-1 instant 和 mini 用 GPT-5.5 Instant,GPT-Live-1 的 Medium 和 High 档位用 GPT-5.5 Thinking 的 medium / high reasoning effort。

GPT-Live-1 的实测能力如何?

库内已收录两条成绩:GPQA 84.20(High 思考档、无工具)在 16 个模型中排第 3;BrowseComp 75.20(High 思考档、带工具与联网)在 54 个模型中排第 26。作为对比,轻量版 GPT-Live-1 mini 的 BrowseComp 只有 31.60、排第 50——两者在需要检索的任务上差距很大。

哪些平台能用 GPT-Live-1?

正在全球范围内向 ChatGPT consumer plans 推出,可在 ChatGPT 的 iOS、Android 和网页端使用。发布时不支持视频、屏幕共享、连接应用或插件,也不在 Business、Enterprise、Edu 工作区等场景开放。Live 语音可使用 web search 和 memory,能显示受支持的小组件视觉结果,并可在同一聊天中处理文本和图片。

GPT-Live-1 有 API 吗?价格多少?

发布时它是 ChatGPT 内的产品能力,公开资料未给出独立的 API 价格、参数规模、上下文长度或知识截止时间。本站对这些字段留空,等官方公布 API 文档后再补。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码