OpenAI 用双工语音模型和 GPT-5.5 重做 ChatGPT Voice
The Batch (Andrew Ng) · rss · 2026-07-22
OpenAI 用一对新的语音模型 GPT-Live-1 和 GPT-Live-1 mini 重做了 ChatGPT Voice,核心变化是从逐轮对话改成了连续处理音频。
- 这套系统是 full-duplex:可以一边听一边说;遇到更难的问题时,会在后台把任务路由给 GPT-5.5。
- 新版支持实时翻译、重制后的固定音色,以及 GPT-Live-1 的推理强度选择。
- OpenAI 公布的内部评测显示,GPT-Live-1 在高推理档的 GPQA 得分为 84.2%,显著高于旧版 Advanced Voice Mode 的 45.3%。
- 在 BrowseComp 这类需要联网检索的任务上,GPT-Live-1 达到 75.2%,而 AVM 只有 0.7%。
- 功能已面向全球 iOS、Android 和 ChatGPT.com 用户开放,Go/Plus/Pro 以及免费用户都能用,但开发者 API 还没上线。
- 文章还提到,OpenAI 可能在把语音做成未来硬件的第一接口,包括一款无屏智能音箱。
「模型」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11
- TheZhi 发起调查:Fable 5.1 与 Astra 发布后,编码模型选择变了吗 — TheZvi · 2026-09-11
- antirez 谈 Anthropic 禁止未成年人使用 Claude — antirez · 2026-09-11
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11