Meta 超级智能实验室发布 Muse Voice Transcribe 实时语音转录
aigclink · x · 2026-09-02
Meta Superintelligence Labs 推出 Muse Voice Transcribe,称其为首个实时音频感知模型,主要能力:
- 实时流式 ASR、端点检测(endpointing);
- 说话人分离(diarization)支持 20+ 说话人;
- 支持 25+ 种语言,原生处理中英混说等语码转换;
- 可通过语言、关键词与上下文偏置提升准确率。
官方称该模型在 Artificial Analysis 流式语音转文字榜及公开 diarization 基准上排名第一(截至 2026 年 9 月 1 日)。官网提供实时麦克风转录 demo,音频不存储。
所属事件:Meta 发布 Muse Voice Transcribe 实时语音转写模型(15 条相关)→
「模型」频道最新
- 分析称 Astra 用循环深度:1.38 倍有效参数乘数 — scaling01 · 2026-09-02
- Claude 首次免搜索从原始权重中认出用户,准确率约 75% — repligate · 2026-09-02
- Fable 5 与 5.1 自画像对比:移除新系统提示词后重测 — repligate · 2026-09-02
- Arena 发布 WebDev AI 榜单:按全栈/前端与领域细分排名 — arena · 2026-09-02
- Astra 疑似用潜在思维链难监测,beffjezos 提出辅助解码器方案 — beffjezos · 2026-09-02
- 传 OpenAI Astra 模型准备中,vega-alpha 等多模型同步测试 — legit_api · 2026-09-02