Hugging Face 演示 BS-Roformer Leap 分离人声和伴奏
multimodalart · x · 2026-07-28
这条帖子介绍了 Hugging Face 上的 BS-Roformer Leap,它主打把人声和伴奏分离得非常干净、精准。
作者还补充了搭建过程:一开始这个模型几乎没有元数据、也没有现成仓库,代理先找到一个相关的 lucidrains 实现,再把 Space 组起来。最终效果被评价为“真的很不错”。
「多模态」频道最新
- “33°C”只是文本,不等于触觉体验 — flowersslop · 2026-07-28
- 一条 Seedance 2.0 提示词复刻 90 年代街机厅 — techhalla · 2026-07-28
- 开发者用 OpenClaw 和 MiniCPM-V 4.6 搭出本地照片助手 — 面壁智能 · 2026-07-28
- 本周论文速览覆盖自改进智能体、latent reasoning 和视频生成 — TheTuringPost · 2026-07-28
- 开源 LuxTTS 号称 1GB 显存实现 150 倍实时语音克隆 — thisguyknowsai · 2026-07-28
- Reddit 用户称 ltx 2.3 的 i2v 仍会把人脸做崩 — Fit_Satisfaction2953 · 2026-07-28