专题 · FULL STORY

YuE2:开源音乐模型对标 Suno 之路

M-A-P 团队发布 3B 参数开源音乐生成模型 YuE2,号称可编辑乐谱生成整首歌并在 WildSongBench 上超越 Suno v5/v6。随后社区迅速跟进,ComfyUI 节点、LoRA 训练器与本地部署方案相继推出,实测显示 4.5GB 显存即可运行。

2026-09-10 ~ 2026-09-16 · 4 集 · 22 条

第 1 集 · 开源音乐模型 YuE2-3B 发布,可编辑乐谱生成整首歌对标 Suno v5(2026-09-10,12 条)

开源音乐生成模型 YuE2-3B 由 M-A-P 团队(多模态艺术投影)发布于 Hugging Face 并登上热门榜,demo 页面已在 map-yue2.github.io 上线。输入歌词和风格提示即可生成最长 5 分钟、带人声和伴奏的完整歌曲,输出 48kHz 立体声,24GB 显卡即可本地运行,支持中英文,可用于创作、翻唱与编辑。多位实测者反馈听感惊艳,但模型与代码均为非商业许可,商用受限,在社区引发热议。

已确认

  • 模型约 3B 参数(一说 3.59B、28 层,AR/NAR 专家架构),已附 arXiv 论文,标签含 music-generation、agentic-editing
  • 主打「白盒」生成流程:模型先产出 ABC 记谱格式的旋律与和弦符号化规划,渲染前可人工查看、播放和编辑这份「作曲计划」,再生成最终歌曲
  • 发布方声称在 WildSongBench 上 YuE2(best-of-8)表现超过 Suno v5;另有转述称整体效果介于 Suno 4.5 到 5.5 之间,多项基准超过 Mureka v9 和 MiniMax 3
  • 社区反馈:@realmrfakename 多次实测认为听感出色、可对标 Suno v5/v5.5,但对非商业许可表示失望;@wzwowzw0002 关注 ComfyUI 何时能接入 YuE2 节点;@bdsqlsz 发帖发问「比 Suno V5 更好吗」,认为实测对比有待社区验证;@Acceptable-Cycle4645 也称 demo 效果相当不错

尚未确认

  • 「对标/超越 Suno v5/v5.5、超过 Mureka v9 与 MiniMax 3」目前主要来自发布方声称与个别用户(@realmrfakename 等)的听感评价,尚缺乏更广泛的独立评测验证

为什么重要

  • 可编辑乐谱使生成过程透明可控,区别于多数端到端黑盒音乐模型,为音乐人提供「先规划后渲染」的新工作流
  • 在 24GB 消费级显卡上本地运行 48kHz 立体声完整歌曲生成,显著缩小开源方案与 Suno 等闭源商用产品的差距
  • 非商业许可是其最大限制,实际商用前景仍不明朗

第 2 集 · 开源音乐模型 YuE2 发布,WildSongBench 分数超 Suno v5/v6(2026-09-14,4 条)

M-A-P 社区发布开源音乐生成模型 YuE2(3B 参数,基于 SheetSage2 微调,采用 diffusion 方法),已上线 Hugging Face 并登上趋势榜,许可证为 cc-by-nc-4.0,支持中英文。它可在 24GB GPU 上本地生成 48kHz 立体声完整歌曲(人声+伴奏),还支持 agent 编辑乐谱。在 192 条 WildSongBench 提示测试中超越 Suno v5/v6 等闭源模型,被视为开源音乐生成的新拐点。

第 3 集 · 开源音乐模型 YuE2 迎来 ComfyUI 节点与 LoRA 训练器(2026-09-15,2 条)

社区开发者与 MachineDelusions 合作,为开源音乐生成模型 YuE2 发布了 ComfyUI-FL-YuE2 节点包,将其歌词作曲与音乐生成能力引入 ComfyUI 生态。节点包支持在 ComfyUI 内直接进行 LoRA 微调训练(借用 RVQ Adapter 成果),并附带教程预告,方便用户定制自己的音乐风格。

第 4 集 · 开源音乐模型 YuE2 实测:4.5GB 显存跑出 Suno 级歌曲(2026-09-15,4 条)

开源音乐生成模型 YuE2 被视为当前最强开源选择,已接入 WanGP,可通过 Pinokio 安装使用。多位开发者实测显示:Pinokio 作者 cocktailpeanut 全程监控显存,生成峰值仅需约 4.5GB VRAM,消费级显卡甚至部分笔记本都能本地运行;另有用户在 RTX 4070 12GB 上以 INT8 量化版本实测(约 8GB 显存),翻唱质量逼近 Suno,生成速度也较快。