YuE2 器乐 LoRA:2700 首纯音乐训练,支持时间戳分段控制
thatisnotmychapstick · reddit · 2026-09-15
作者发布了一个面向开源音乐生成模型 YuE2 的器乐(instrumental)LoRA,训练数据为 100+ 流派的 2700 首纯音乐曲目。
- 三种歌词字段提示法:
- 裸提示 [instrumental]:模型自行决定结构与长度;
- 非计时标签:只指定 [intro] [verse] [chorus] 等段落顺序,时值交给模型;
- 计时标签:为每段给出 m:ss 起止时间(训练时用了真实曲目的精确段落时间),是结构控制最强的写法——模型跟随段落顺序和比例比绝对时间更好,且无论怎么规划都倾向生成 3–5 分钟的歌。
- 推理时开启 COT=full(思维链)可显著提高纯器乐输出的命中率。
- 样例发布在作者 YouTube 频道。
「多模态」频道最新
- 一条视频生成 4D 高斯泼溅,4DAnyone 实测体验分享 — mickmumpitz · 2026-09-15
- 42 秒渲染一帧的 Blender 官方图被转成 3D 高斯泼溅实时浏览 — willeastcott · 2026-09-15
- DeepMind 实习成果:把价值图放进 VLM 思维链,多模态潜在推理提效 20% — burny_tech · 2026-09-15
- 被嘲「AI slop」的中国创作者,把 AI 视频做成了职业 — HeyZoyaKhan · 2026-09-15
- Grok Imagine 出图 + MiniMax H2 生成视频的创作组合 — creatoroff · 2026-09-15
- Niessner:RTX 5070 每秒可渲染数十亿三角形,实时 3D 仍无可替代 — CSProfKGD · 2026-09-15