OpenAI 研究员吐槽:语音模型为何还做不到真人式实时对话

willdepue · x · 2026-09-22

OpenAI 研究员 Will Depue 向 Nat Friedman 列举当前聊天形态的一系列缺陷:双向语音模型已存在,却仍没有真正的实时双向打断;界面是「聊天」而非单一连续流,模型消息不能编辑;语音输出缺乏真正的 omni 能力——GPT Voice 不能做音效或 beatbox,音乐生成用的还是非前沿模型。他还指出模型知识有奇怪空洞:推荐电影/音乐的表现远低于预期,因为模型往往没真正看过或读过剧本。

所属事件:OpenAI 研究员细数 LLM 短板:上下文污染与全模态缺失(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →