Meta 发布 Muse 语音模型:支持 70+ 语言实时转录
alexandr_wang · x · 2026-09-02
Meta 推出了首个实时音频感知模型 Muse Voice Transcribe。该模型支持 70 多种语言的实时转录,并能区分 20 多位说话人(Diarization)。目前该功能已在 Meta AI 的 macOS 应用中上线。
所属事件:Meta 发布 Muse Voice Transcribe 实时语音转写模型(17 条相关)→
「多模态」频道最新
- 博主称其开源方案与 World Labs Atlas 异曲同工 — mickmumpitz · 2026-09-02
- 实测主流视频生成模型:Seedance 2.5 效果惊艳 — madeofAjala · 2026-09-02
- DLSS 5 噪声抑制插件登陆 ComfyUI,实测效果惊人 — Choidonhyeon · 2026-09-02
- Synthesia 高管谈 AI 视频技术与深度伪造防护 — alexvoica · 2026-09-02
- 「城市在眨眼」:一条30秒一镜到底的文生视频提示词 — umesh_ai · 2026-09-02
- 基于 MiniMax H3 的实时开放世界视频互动冒险 — yogev77 · 2026-09-02