Chrome 新回声消除器让语音 Agent 词错率减半,不再自问自答
chadwallacehart · x · 2026-10-10
webrtcHacks 的 Philipp Hancke 发文分析 Chrome 新推出的基于机器学习的残余回声估计器对语音 Agent 的实际影响:它比单独的 AEC3 消除更多回声,可将语音 Agent 对近端说话人转写的词错率减半。
文章指出,回声泄漏对普通通话只是干扰,但对语音 Agent 却是输入:VAD 判定有人说话、STT 转成文字、LLM 作答、TTS 播出,形成闭环。作者用服务器日志实锤了这一现象——Agent 把自己问候语的回声当作用户发言("USER: Hmm.")并认真回复,产生幻影轮次。
文中给出了从日志定位问题的排查思路:对比 response complete(重新开始监听)时间与 Speech started 事件,发现触发语音的正是回声尾巴。Chrome 新回声消除器同时显著降低了 Agent "接听后回答自己" 的发生频率。
「编程与Agent」频道最新
- Claude Code 自主修复多年老 Bug:提 PR、部署、写脚本补数据 — mhmazur · 2026-10-10
- 为何 OpenAI 用 DIL 而非 HTML+iframe?一次渲染多端原生是关键 — soleio · 2026-10-10
- Jev 生态爆发:browser-use 等 5 个项目把它塞进 Agent 决策链 — Arindam_1729 · 2026-10-10
- Cloudflare 免费送每日千封外发邮件,让 Agent 装个 CLI 就能用 — tristanbob · 2026-10-10
- 宝玉分享 Agent 编程闭环:快速反馈+多任务并行提效 — dotey · 2026-10-10
- 安全研究员:漏洞赏金用开源模型就够,闭源模型对黑盒目标更犹豫 — rez0__ · 2026-10-10