Sony AI 开源 MIMO 迭代音频分离框架,任意模型可套用

petewoodbridge · x · 2026-09-10

Sony AI 发布 MIMO 迭代音频分离扩展:一个与架构无关的通用框架,能把任何单步音频源分离模型改造成迭代精修模型,并严格保持混合一致性(mixture consistency)。

核心思路:

已应用到 SCNet(Vocals/Bass/Drums/Other)和 BS-RoFormer(Vocals/Accompaniment),带来更干净的卡拉OK人声去除、更好的乐器隔离、更少的泄漏与伪影。论文和 PyTorch 官方实现均已开源,对音乐制作人、DJ、音频修复和音乐生成等场景实用。

所属事件:Sony AI开源MIMO迭代式音乐分离通用框架(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →