阿里开源两款语音增强模型,凑齐七模型体系

阿里新开源两个 AI 语音增强模型,补齐覆盖背景噪声、回声、多人抢话三类真实语音问题的系统化方案,至此开源语音增强模型达 7 个。其中 FLASepformer 针对语音分离,采用线性注意力解决传统分离计算量随音频长度平方级暴涨的问题,提速约 1.52.3 倍;回声消除模型延迟仅 22ms。

2026-09-10 ~ 2026-09-10 · 2 条相关

另有 1 条近重复转述:aigclink