PolyAI 发布原生音频大模型 Dialog-RSN-1,攻克语音智能体信息瓶颈

matthen2 · x · 2026-07-30

PolyAI 推出了全新的语音对话模型 Dialog-RSN-1。与传统级联架构(ASR+LLM+TTS)和直接语音到语音模型相比,该模型将轮次判断、语音识别、函数调用和响应生成融合在单一的原生音频模型中。

这种架构避免了级联系统的信息瓶颈(如丢失语气、无法处理 ASR 漏识别)以及语音到语音模型难以控制的缺点。目前该模型已在企业生产环境中处理实时通话,实现了极低的延迟,使对话体验比传统级联系统更加流畅和智能。

所属事件:PolyAI发布端到端原生音频对话模型Dialog-RSN-1(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →