YuE2-3B 开源音乐模型:乐谱可编辑,24G 显卡本地跑 48kHz 立体声
realmrfakename · x · 2026-09-10
开源音乐生成模型 YuE2-3B 发布,据称效果对标 Suno v5:输入歌词和风格提示即可生成带人声与伴奏的完整歌曲,还能通过可编辑乐谱调整旋律与和弦。WildSongBench 上 YuE2(best-of-8)的 SongBench 平均分 6.9632,超过 Suno v5 的 6.8721,在评测的全部开源与闭源模型中最高。
核心特性:
- 生成与编辑模式:旋律+和声、纯旋律或直接生成,也支持自带 ABC 乐谱
- Agent 式编辑:把音乐反馈转成乐谱、风格与歌词修改,再渲染新版本
- 本地运行:24GB GPU 无量化即可生成 48kHz 立体声歌曲
- 架构:AR–NAR Mixture-of-Transformers 骨干先写乐谱与语义 token,再经 flow matching 生成声学 latent,由 VAE 转为立体声音频
模型与代码采用 CC-BY-NC-4.0 非商业许可,提供 Hugging Face 加载、CFG 文本引导以及规划/合成分离 API。
所属事件:开源音乐模型 YuE2 发布,可编辑乐谱生成长歌(3 条相关)→
「多模态」频道最新
- ECCV 论文 Flash-BoN:廉价草稿+高效验证,扩散模型推理时扩展提速 — gowthami_s · 2026-09-10
- 阿里再开两源补齐语音增强拼图:线性注意力提速 2 倍、回声消除仅 22ms 延迟 — aigclink · 2026-09-10
- 78 秒 AI 短片:猪女孩大闹维京冬季盛宴 — Substantial_Depth744 · 2026-09-10
- ChatGPT 机甲风格图片生成提示词玩法分享 — Promptmethus · 2026-09-10
- 低延迟语音公司 Gradium TTS 上线 LiveKit 推理平台,首月免费 — mattturck · 2026-09-10
- 同一超现实提示词实测:MiniMax H3 及格,Kling 与 Seedance 翻车 — charis_ai · 2026-09-10