网易有道开源 2B 语音模型 Confucius R2T2,200ms 实时转写
dr_cintas · x · 2026-09-17
网易有道发布了开源语音识别模型 Confucius R2T2,规模 2B,可实时转写、延迟约 200ms。其特点是「逐词提交、永不回写」:每个词一经识别即输出,不会回头重写,适合流式场景。模型完全开源。
所属事件:网易有道开源 2B 流式 ASR 模型 Confucius R2T2(15 条相关)→
「多模态」频道最新
- 创作者用 Runway 制作甘尼许节「旧物新生」循环视频 — CurieuxExplorer · 2026-09-17
- 分享 AI 生成速度对比请加计时节点,控制台时长常不准 — CurrentMine1423 · 2026-09-17
- 5B 实时世界模型 Zing-0.5 发布:键盘+文字联控,24 FPS 每分钟约 0.9 美分 — Mingyang Chen · 2026-09-17
- Seedance 2.5 生成短片:人群定格,唯独她继续前行 — SimplyAnnisa · 2026-09-17
- AI 生成影片冲击电影节:Lumara 电影节收到生成式 AI 提交作品 — Kyrannio · 2026-09-17
- Google 发布 Gemma 3n:2GB 内存可跑,首个 LMArena 破 1300 的 10B 以下模型 — joemeno · 2026-09-17