网易有道开源 Confucius4-R2T2 实时语音识别,延迟仅 200~600ms

aigclink · x · 2026-09-20

网易有道发布实时语音识别模型 Confucius4-R2T2(已开源),基于 Qwen3-ASR,主打「实时字幕不跳字」。

适合直播字幕、会议同传、语音客服、下游 NLP/LLM Agent 管道等需要即时处理文本的场景。模型与 WebSocket 服务端/客户端示例均已放在 GitHub(netease-youdao/Confucius4-R2T2)。

所属事件:网易有道开源实时语音识别模型 Confucius4-R2T2(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →