微软开源流式语音识别模型 VibeVoice-ASR-Streaming-7B

微软在 Hugging Face 上发布了 VibeVoice-ASR-Streaming-7B,一个 70 亿参数的流式自动语音识别模型,权重已开放下载。该模型支持流式语音输入转文字,是 VibeVoice 系列的新成员。社区对这一开源举措反应积极,认为为开发者提供了可本地部署的高质量流式 ASR 能力。

2026-09-02 ~ 2026-09-03 · 2 条相关