小米开源 CocktailASR-1:锁定单一目标说话人的语音识别 SOTA

solyarisoftware · x · 2026-09-17

小米发布目标说话人语音识别大模型 Xiaomi-CocktailASR-1,通过参考声纹从混合音频中定位并只转写目标人声,开源在 GitHub。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →