微软发布 VibeVoice-ASR-Streaming-7B:流式语音识别开源模型

microsoft · hf · 2026-09-02

微软在 Hugging Face 发布 VibeVoice-ASR-Streaming-7B,一个 7B 参数的流式自动语音识别(ASR)模型,支持语音转文字(Speech-to-Text)与转写任务,覆盖中文与英文,基于 transformers 架构并以 safetensors 格式提供权重。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →