本地音乐模型 Yue2 能否做到真·参考音频生成?社区求方案

Ambitious_Fold_2874 · reddit · 2026-09-18

Reddit 用户发帖询问:Yue2 或其他本地音乐模型能否实现真正的 reference2audio——输入参考音频后,结合上下文与用户指令生成新音频,类似 MiniMax 语音模型的 ref2va 能力。

发帖人观察:Yue2 目前的做法似乎只是从参考音频中提取音符与旋律,再用其生成音乐,而非真正以参考音频为条件做上下文感知生成。评论区在讨论本地部署下是否存在等效方案。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →