PolyAI 发布端到端语音模型 Dialog-RSN-1

matthen2 · x · 2026-07-30

PolyAI 推出了端到端语音对话大模型 Dialog-RSN-1。该模型将轮次决策、逻辑推理、语音回复与转录整合在一个端到端架构中。

模型预测的首个 token 用于决定是否开口说话,从而实现了高度可控的对话轮次切换、精准的打断响应以及极快的交互速度。它能根据环境背景音主动建议用户更换地点,并支持识别情绪、口音和语速。

所属事件:PolyAI发布端到端原生音频对话模型Dialog-RSN-1(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →