微软发布 VibeVoice-ASR-Streaming:首个 LLM 端到端流式说话人归属识别

realmrfakename · x · 2026-09-04

微软团队(含 Li Dong、Furu Wei 等)发布论文《VibeVoice-ASR-Streaming Technical Report》,提出首批基于 LLM 的端到端流式说话人归属 ASR 之一:

所属事件:微软开源 VibeVoice 流式语音识别模型,转写兼区分说话人(6 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →