Meta 发布 Muse Voice Transcribe:流式语音转写 SOTA

9 月 2 日,Meta Superintelligence Labs 正式发布首个实时音频感知模型 Muse Voice Transcribe,在流式语音转文字(ASR)任务上达到 SOTA 水平。据 Artificial Analysis,该模型在 AA-WER Streaming 基准上以 3.1% WER 夺得最终转录准确率第一。这是 Meta 从语音转录切入实时音频感知的第一款产品,Scale AI 创始人 Alexandr Wang 同日发文介绍,多位独立观察者(如 @rohanpaulai、@bowenc0221)密集转发,该发布被视为 Scale AI 与 Meta 整合后的标志性成果。

已确认

为什么重要

2026-09-02 ~ 2026-09-02 · 10 条相关

一手来源

另有 2 条近重复转述:bowenc0221 · rohanpaul_ai