OpenAI 发布全双工语音模型 GPT-Live

7月9日,OpenAI 正式发布并上线了新一代全双工语音模型 GPT-Live,标志着 ChatGPT 语音交互能力迎来重大升级。该模型支持更自然的边听边说与随时打断体验,旨在让人机对话如同真实交流般流畅。

关键细节与版本分配

GPT-Live 的核心突破在于将语音对话与繁重的计算任务分离。当遇到需要搜索或深度推理的复杂问题时,模型会在后台将任务交给前沿模型(发布时为 GPT-5.5)处理,同时保持语音对话不中断。此外,它还能实时生成 UI 界面,以天气、股票、体育等可视卡片的形式展示信息。版本方面,GPT-Live-1 作为 Go、Plus 和 Pro 用户的默认版本,GPT-Live-1 mini 则面向免费用户。OpenAI 还预告将把这两个版本接入 API,并已开放给开发者和企业注册通知。

性能提升与产品演进

据 @testingcatalog 提供的数据,GPT-Live-1 在 GPQA、BrowseComp 以及内部 τ³-Voice Telecom 测试等多个维度上均显著优于之前的 Advanced Voice Mode。该模型最初曾被命名为“GPT Bidi 1”,后正式更名为 GPT Live 1,以统一语音产品线的命名规范。官方在近期的直播演示中还展示了其图像交互等新能力。

2026-07-07 ~ 2026-07-09 · 44 条相关

事件全程(共 12 集)→

一手来源

另有 5 条近重复转述:OpenAI · BLCNYY · 赛博禅心 · AGI Hunt · bowenc0221