Meta 推出 MuseVoiceTranscribe:支持 20+ 说话人的实时语音感知

智东西 · wechat · 2026-09-02

Meta 发布了首个实时音频感知模型 MuseVoiceTranscribe,该模型旨在将语音转写升级为 AI 系统的实时感知层。主要能力与特性包括:

该模型已集成至 Meta AI、MuseCode 及 MetaModelAPI,定价约为每 1000 分钟 3 美元。

所属事件:Meta 发布 Muse Voice Transcribe 实时语音转写模型(15 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →