特斯拉Grok语音沙哑却不自知:语音模型听不见自己发声

PTrubey · x · 2026-10-07

作者发现 Tesla 里的 Grok 语音助手(Rex)声音偶尔变得沙哑近乎耳语,向它反馈却被否认——因为 Grok 根本听不到自己发出的声音,也无法直接控制发声。

架构上,发声是由一个独立的子系统/模型完成的,负责“思考”和组词的主模型无法访问它的输出。作者对比人类:我们的喉部出问题时能自己听到并代偿,而 Grok 只能切换到另一个发声模型,完全无法感知自己的语音输出。

作者的结论:当前很多 AI 系统靠工程补丁和捷径交付“能跑”的产品,与人类和世界交互的方式相差甚远;在感知与行动的整合效率提升几个数量级之前,这类“听不见自己声音”的 hack 还会大量存在。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →