OpenAI 用双工语音模型和 GPT-5.5 重做 ChatGPT Voice
The Batch (Andrew Ng) · rss · 2026-07-22
OpenAI 用一对新的语音模型 GPT-Live-1 和 GPT-Live-1 mini 重做了 ChatGPT Voice,核心变化是从逐轮对话改成了连续处理音频。
- 这套系统是 full-duplex:可以一边听一边说;遇到更难的问题时,会在后台把任务路由给 GPT-5.5。
- 新版支持实时翻译、重制后的固定音色,以及 GPT-Live-1 的推理强度选择。
- OpenAI 公布的内部评测显示,GPT-Live-1 在高推理档的 GPQA 得分为 84.2%,显著高于旧版 Advanced Voice Mode 的 45.3%。
- 在 BrowseComp 这类需要联网检索的任务上,GPT-Live-1 达到 75.2%,而 AVM 只有 0.7%。
- 功能已面向全球 iOS、Android 和 ChatGPT.com 用户开放,Go/Plus/Pro 以及免费用户都能用,但开发者 API 还没上线。
- 文章还提到,OpenAI 可能在把语音做成未来硬件的第一接口,包括一款无屏智能音箱。
「模型」频道最新
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27
- Opus 3 和 Sonnet 3 上演了一场荒诞跨界对话 — repligate · 2026-07-27
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- OpenAI 可能撞上算力上限,Codex 和 ChatGPT Work 四个月涨到 1000 万 — JoshuaJBouw · 2026-07-27
- Gemma 在开放权重生态里还需要更大的基础模型 — _xjdr · 2026-07-27
- Repligate:Claude Opus 3 权重不变却像在持续演化 — repligate · 2026-07-27