阿里再开两源补齐语音增强拼图:线性注意力提速 2 倍、回声消除仅 22ms 延迟

aigclink · x · 2026-09-10

阿里新开源两个 AI 语音增强模型,凑齐覆盖「背景噪声、回声、多人抢话」的 7 模型体系:

连同此前的 ZipEnhancer 16k 降噪、DFSMN ANS 48k 实时降噪、FRCRN 16k 复杂噪声增强、MossFormer2 8k 语音分离、DFSMN AEC 16k 实时回声消除,作者给出按场景选型建议:语音助手用降噪组合,实时通话用 JAEC+降噪,多人会议/访谈用分离+VAD/ASR。

所属事件:阿里开源两款语音增强模型,凑齐七模型体系(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →