Scale AI 发布 Muse Voice Transcribe:首个实时语音感知模型
rohanpaul_ai · x · 2026-09-02
Scale AI 推出 Muse Voice Transcribe,这是其首个实时音频感知模型。该模型在流式语音转文本(Speech-to-Text)方面达到 SOTA 水平,并能在单一模型中原生处理说话人分离(diarization)和端点检测(endpointing)。
所属事件:Meta 发布 Muse Voice Transcribe:流式语音转写 SOTA(10 条相关)→
「模型」频道最新
- Perplexity 接入 Claude Fable 5.1,成本降 37% — perplexity_ai · 2026-09-02
- Anthropic Fable 5.1 系统提示词泄露,长达 27 万字符 — Scobleizer · 2026-09-02
- Fable 5.1 模型集成 Anthropic 统计文本水印 — RaGE_Syria · 2026-09-02
- 多智能体评测缺乏模型间对比,需更多细节 — scaling01 · 2026-09-02
- Fable 5.1 跑分超 GPT-5.6,成本仅六成 — haider1 · 2026-09-02
- 疑 Claude Fable 5.1 增加过多指令,似过度对齐 — teodorio · 2026-09-02