Chrome 新回声消除器让语音 Agent 词错率减半,不再自问自答

chadwallacehart · x · 2026-10-10

webrtcHacks 的 Philipp Hancke 发文分析 Chrome 新推出的基于机器学习的残余回声估计器对语音 Agent 的实际影响:它比单独的 AEC3 消除更多回声,可将语音 Agent 对近端说话人转写的词错率减半。

文章指出,回声泄漏对普通通话只是干扰,但对语音 Agent 却是输入:VAD 判定有人说话、STT 转成文字、LLM 作答、TTS 播出,形成闭环。作者用服务器日志实锤了这一现象——Agent 把自己问候语的回声当作用户发言("USER: Hmm.")并认真回复,产生幻影轮次。

文中给出了从日志定位问题的排查思路:对比 response complete(重新开始监听)时间与 Speech started 事件,发现触发语音的正是回声尾巴。Chrome 新回声消除器同时显著降低了 Agent "接听后回答自己" 的发生频率。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →