微软发布 VibeVoice-ASR-BitNet:一款多语种语音识别模型
microsoft · hf · 2026-07-24
微软发布 VibeVoice-ASR-BitNet,多语种语音识别模型
微软上线了新的 VibeVoice-ASR-BitNet,这是一个 自动语音识别(ASR) 模型发布,支持 多语种,并提供了多种面向部署的格式,包括 GGUF、ggml 和 safetensors。
从标签看,这次发布重点放在推理落地能力上,涉及 BitNet、量化 和 CPU 推理,更像是一个轻量化语音识别部署方案,而不是研究论文。
「模型」频道最新
- Gemini 3.6 Flash 在新一轮对比中胜过 Muse Spark 1.1 xhigh — realsohamparekh · 2026-07-24
- GPT-5.x Pro 仍领跑高难技术任务,竞品深思变体退场 — emollick · 2026-07-24
- 工程师称美国模型频繁拦安全测试,被迫改用中文模型 — kristoph · 2026-07-24
- 用户称 Opus 4.8 变笨,Fabel 5 只是更早的聪明版 — imdigitalashish · 2026-07-24
- Reddit 把 Kimi K3 和 Qwen 3.8 Max 比成速度与自主性之争 — Remarkable-Dark2840 · 2026-07-24
- 一位视频脚本作者说 Kimi K3 首稿能力明显更强了 — Silver-Perception811 · 2026-07-24