Scale AI 发布 Muse Voice Transcribe:首个实时语音感知模型

rohanpaul_ai · x · 2026-09-02

Scale AI 推出 Muse Voice Transcribe,这是其首个实时音频感知模型。该模型在流式语音转文本(Speech-to-Text)方面达到 SOTA 水平,并能在单一模型中原生处理说话人分离(diarization)和端点检测(endpointing)。

所属事件:Meta 发布 Muse Voice Transcribe:流式语音转写 SOTA(10 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →