微软开源 VibeVoice-ASR-Streaming-7B 流式语音识别模型

Acceptable-Cycle4645 · reddit · 2026-09-03

微软在 Hugging Face 上发布了 VibeVoice-ASR-Streaming-7B,一个支持流式输入的语音识别(ASR)模型,权重已开放下载。作为 VibeVoice 系列的 ASR 版本,它面向实时语音转写场景,7B 参数规模在开源 ASR 模型中体量较大,适合需要低延迟流式识别的开发者关注。

所属事件:微软开源流式语音识别模型 VibeVoice-ASR-Streaming-7B(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →