OpenAI 研究员吐槽:语音模型为何还做不到真人式实时对话
willdepue · x · 2026-09-22
OpenAI 研究员 Will Depue 向 Nat Friedman 列举当前聊天形态的一系列缺陷:双向语音模型已存在,却仍没有真正的实时双向打断;界面是「聊天」而非单一连续流,模型消息不能编辑;语音输出缺乏真正的 omni 能力——GPT Voice 不能做音效或 beatbox,音乐生成用的还是非前沿模型。他还指出模型知识有奇怪空洞:推荐电影/音乐的表现远低于预期,因为模型往往没真正看过或读过剧本。
所属事件:OpenAI 研究员细数 LLM 短板:上下文污染与全模态缺失(3 条相关)→
「模型」频道最新
- 实测 105 个真实 bug:Grok 4.7 得 28.7 分,未胜 Grok 4.6 — PawelHuryn · 2026-09-22
- 曝 OpenAI 正测试 Aeon 持久推理模式,任务不完成不停止 — imjustnewatai · 2026-09-22
- 四大模型横评:GPT-6 Astra 与 Claude Fable 5.1 领跑 40 余项基准 — HealthySkeptic2000 · 2026-09-22
- Grok 4.7 xHigh 距登顶仅 1 分:58% 对 Claude Fable 5.1 Max 的 59% — XFreeze · 2026-09-22
- 让两大前沿模型操纵真实机器人玩夺旗,Gemini 以 70% 胜率碾压对手 — chris_j_paxton · 2026-09-22
- ChatGPT Pro 的 Chat 模式首次出现限速提示,细节不明 — pred · 2026-09-22