阿里开源两款语音增强模型,凑齐七模型体系
阿里新开源两个 AI 语音增强模型,补齐覆盖背景噪声、回声、多人抢话三类真实语音问题的系统化方案,至此开源语音增强模型达 7 个。其中 FLASepformer 针对语音分离,采用线性注意力解决传统分离计算量随音频长度平方级暴涨的问题,提速约 1.52.3 倍;回声消除模型延迟仅 22ms。
2026-09-10 ~ 2026-09-10 · 2 条相关
- 阿里再开两源补齐语音增强拼图:线性注意力提速 2 倍、回声消除仅 22ms 延迟 — aigclink · 2026-09-10
另有 1 条近重复转述:aigclink