Sarvam AI 发布多说话人语音识别模型 Saaras V4

itsOmSarraf_ · x · 2026-07-30

Sarvam AI 推出了其最新的语音识别模型 Saaras V4 Multi-speaker。该模型主打对复杂场景下多说话人交互及重叠对话的精准捕捉。

此外,模型在各种英语口音的识别上均达到了业界领先水平(SOTA),进一步突破了真实嘈杂环境下的语音转写瓶颈。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →