开源音乐模型 YuE2 缺失的编码器被社区补齐,可导入自有音乐
thatisnotmychapstick · reddit · 2026-09-14
Reddit 用户为开源音乐生成模型 YuE2 训练并发布了官方缺失的音频编码器(encoder),将其转换为模型内部使用的 semantic tokens,从而让用户能把已有录音导入 YuE2 流程做风格化生成或微调。YuE2 本身可根据风格提示和歌词生成完整歌曲,但官方从未发布把现有音频编码成 semantic tokens 的模块。作者在仓库中附带了脚本和 tokenizer 权重。
「多模态」频道最新
- 黑客松 demo InnerTone:用 Codex 造浏览器内音乐编译器 — cedric_chee · 2026-09-14
- 本地 AI 创作全家桶 Maestro:一键装 Pinokio,6GB 显存起步 — cocktailpeanut · 2026-09-14
- Ambient 将长视频感知蒸馏进 2B 模型,夺冠自我中心长视频问答 — ambient-intelligence-labs · 2026-09-14
- React Native 虚拟试穿 App 亮相:实测 Segmind 与 fal.ai 双方案 — Visual_Art523 · 2026-09-14
- 拉了 LTX 2.5 权重就被开发者私信追问部署环境 — SHEEP_PIZZA · 2026-09-14
- 英国晨间节目访谈 AI 生成演员,尴尬停顿暴露 AI 痕迹 — ZeroStateReflex · 2026-09-14