OpenAI 于 2026 年 7 月 9 日发布 GPT-Live 系列全双工语音模型,包括 GPT-Live-1 和 GPT-Live-1 mini 两个版本,即日起向全球 ChatGPT 用户开放。其中 GPT-Live-1 面向 Go、Plus 和 Pro 订阅用户,免费用户可使用 GPT-Live-1 mini。
GPT-Live 系列采用全双工架构,可同时处理输入和输出,每秒多次判断是否说话、继续倾听、暂停、打断或调用工具,使对话更接近真人体验。面对复杂任务时,模型在前台维持语音对话流,同时将网页搜索、复杂推理等委托给 GPT-5.5 系列模型后台执行:GPT-Live-1 (instant) 和 GPT-Live-1 mini 调用 GPT-5.5 Instant;GPT-Live-1 Medium 调用 GPT-5.5 Thinking Medium;GPT-Live-1 High 调用 GPT-5.5 Thinking High。
在性能方面,OpenAI 建立了新的人工评测体系,重点考察舒适度和流畅性。相比 Advanced Voice Mode,在 5-10 分钟的配对对话中,GPT-Live-1 和 GPT-Live-1 mini 在整体偏好、轮次衔接、打断情况、对话流畅度等指标上得分更高。目前每周有超过 1.5 亿人通过 Voice 和 Dictation 等功能与 ChatGPT 语音交互,应用场景包括免手持协助、语言练习、睡前故事等。
新版本支持在语音对话中展示天气、股票、体育等可视化卡片,并继续支持搜索、记忆、图片和文件上传。安全方面,GPT-Live 在自伤、精神病症状、情感依赖、暴力及性内容等领域接受了音频原生评测、合成音频评测与内部红队测试,在几乎所有评估维度上与 Advanced Voice Mode 相当或更优。