Decagon:用说话人嵌入+音频原生模型检测有效说话人切换

Scobleizer · x · 2026-08-28

客服语音智能体面临一个现实难题:真实环境嘈杂,背景有其他人声、用户还可能同时和别人说话。智能体需要判断什么时候真的换了说话人,而不是把背景人声都当成参与者。

Decagon 的做法是把说话人嵌入与一个后训练的音频-语言模型结合,判断某次说话人变化是否与当前对话相关。文章出自 Decagon 工程团队的博客。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →