开源音乐模型 YuE2 缺失的编码器被社区补齐,可导入自有音乐

thatisnotmychapstick · reddit · 2026-09-14

Reddit 用户为开源音乐生成模型 YuE2 训练并发布了官方缺失的音频编码器(encoder),将其转换为模型内部使用的 semantic tokens,从而让用户能把已有录音导入 YuE2 流程做风格化生成或微调。YuE2 本身可根据风格提示和歌词生成完整歌曲,但官方从未发布把现有音频编码成 semantic tokens 的模块。作者在仓库中附带了脚本和 tokenizer 权重。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →