OpenAI 发布 GPT-Live 语音模型,主打全双工实时交互

7 月中旬,OpenAI 正式发布了下一代语音模型 GPT-Live,核心卖点是将语音交互推向更自然、可实时往返的“全双工”对话模式。这一发布标志着 AI 语音能力从传统的“一问一答”向更流畅的实时沟通迈进,其展示出的复杂环境抗干扰能力也引发了社区的广泛关注与实测。

关键细节

官方信息明确将 GPT-Live 定位为面向语音能力的重大升级。OpenAI 同步放出了介绍页与演示视频《Background Robustness with GPT-Live》,重点展示了该模型的背景鲁棒性,即在有环境噪声或背景声音干扰时,依然能保持良好的语音交互表现。

外部解读与实测

围绕本次发布,多位博主与节目分享了更具体的功能解读。emmanuelvivier 指出,GPT-Live 是实时全双工语音,用户不必再等待模型说完才能开口,对话可以像人与人交流一样自然插话。thione 补充称该模型支持更自然的打断、实时翻译和实时对话。此外,thursdaipod 在实测后表示,OpenAI 新上线的全双工对话引擎已经能实现真正自然的来回说话,并感叹这距离此前涉及 Scarlett Johansson 的语音争议事件已过去一段时间,如今 GPT 终于能进行更像真实对话的交互。

2026-07-13 ~ 2026-07-15 · 6 条相关

事件全程(共 12 集)→

一手来源

另有 1 条近重复转述:OpenAI