ComfyUI 接入 YuE2 音乐生成:流程分四段,还能改乐谱再续生成
imlo2 · reddit · 2026-09-11
开发者发布 ComfyUI-Olm-YuE2,把新发布的开源音乐生成模型 YuE2 完整接入 ComfyUI,且不只是套个 Generate 按钮:
- 分阶段管线:生成拆为 Plan > Semantic > Synthesize > Decode 四段,中间结果可查看、保存、复用和分支。
- 乐谱 UI(可选):侧栏渲染五线谱、查看/编辑 ABC 记谱,可先生成 plan、手改乐谱,再从编辑版继续生成。
- 输入输出:支持按音乐风格 + 歌词直接生成 48 kHz 立体声歌曲。
- 工程细节:复用 ComfyUI 现有 Torch/Transformers,仅需额外装 tiktoken 和 accelerate;附实测 VRAM 数据(作者在 RTX 5090 测试)与显存 offload 方案;权重不含,README 说明所需 YuE2 文件与放置位置;环境为 CUDA 13.0 + Python 3.13。
仓库已在 GitHub 开源,作者征集 16/24GB 显卡的实测反馈。
「多模态」频道最新
- 分段生成法治 Img2Video 鬼影:3 段 4 秒比 1 段 12 秒更好还快一倍 — Key_Education4018 · 2026-09-11
- 面部捕捉系统v3取得进展,实时人脸重建现曙光 — andrew_n_carr · 2026-09-11
- 单词即出图:Midjourney 提示词系列用苏格兰词 Smeddum 生成风格图 — tisch_eins · 2026-09-11
- 又一例 GPT-6 Astra 一次性生成完整动画,作者直呼不可思议 — paw_lean · 2026-09-11
- 7500万播放的火山喷发视频作者公开 AI 提示词 — charis_ai · 2026-09-11
- Magnific 演示 GPT-6 Astra 联动 MCP:一段对话导演动态图形视频 — charis_ai · 2026-09-11