微软开源流式语音识别模型 VibeVoice-ASR-Streaming-7B
微软在 Hugging Face 上发布了 VibeVoice-ASR-Streaming-7B,一个 70 亿参数的流式自动语音识别模型,权重已开放下载。该模型支持流式语音输入转文字,是 VibeVoice 系列的新成员。社区对这一开源举措反应积极,认为为开发者提供了可本地部署的高质量流式 ASR 能力。
2026-09-02 ~ 2026-09-03 · 2 条相关
- 微软发布 VibeVoice-ASR-Streaming-7B:流式语音识别开源模型 — microsoft · 2026-09-02
- 微软开源 VibeVoice-ASR-Streaming-7B 流式语音识别模型 — Acceptable-Cycle4645 · 2026-09-03