开源音乐模型 YuE2-3B 发布:SongBench 超 Suno v5,24GB 显卡可跑
realmrfakename · x · 2026-09-10
M-A-P 团队在 Hugging Face 发布开源音乐生成模型 YuE2-3B,称可对标乃至超越 Suno v5.5。
- 能力:歌词+风格提示生成最长 5 分钟完整歌曲(人声+伴奏),支持通过可编辑乐谱(ABC 格式)塑造旋律与和弦,支持 agent 编辑闭环(反馈→乐谱/风格/歌词修订→重新渲染)
- 成绩:WildSongBench 上 best-of-8 的 SongBench 均分 6.9632,高于 Suno v5 的 6.8721,为所有已评测开源与闭源模型最高
- 架构:AR–NAR Mixture-of-Transformers 骨干先写乐谱与语义 token,再经 flow matching 生成声学 latent,VAE 解码为立体声
- 部署:24GB 显存即可本地跑 48kHz 立体声(免量化)
遗憾点:模型与代码均为非商用许可(cc-by-nc-4.0)。
所属事件:开源音乐模型 YuE2-3B 发布,可编辑乐谱生成整首歌对标 Suno v5(12 条相关)→
「模型」频道最新
- Meta Muse 发布 7 天 X 上已现 20 万+ 帖子 — ChrisUniverse · 2026-09-16
- 多名用户收到 Anthropic 用量退款邮件,官方终于给出解释 — Darpinian · 2026-09-16
- 繁体中文视觉基准 VisTW:你的 VLM 读得懂台湾街景和考卷吗 — piske_usagi · 2026-09-16
- 无需推理轨迹也能蒸馏领域专家模型,隐式路径决定泛化 — Yilei Tu · 2026-09-16
- Claude Opus 5 写 PR 会主动「自曝」开发中犯的所有错误 — repligate · 2026-09-16
- DeepSeek V4.1 Flash 单次生成潜艇 3D 模型,零素材纯代码建模 — teortaxesTex · 2026-09-16