开源音乐生成缺"翻唱模式":ACE-Step 1.5 翻车,Minimax 未开放音频输入
maxiedaniels · reddit · 2026-09-11
Reddit 用户发帖求助:目前几乎找不到好用的"cover mode"(参考音频翻唱)音乐生成模型。作者实测 ACE-Step 1.5 的 cover 模式效果很差;原本期待 Minimax Music 3 会为开放权重版本提供音频输入,但至今没有开放。作者感叹新出的音乐生成模型几乎都是纯文生音频,缺乏以音频为输入的翻唱能力。
「多模态」频道最新
- 免 refmod 的 ComfyUI 即时参考工作流:带语音的角色视频一键生成 — crinklypaper · 2026-09-12
- Runway 推出 MCP 服务,可直接在 ChatGPT 和 Claude 里生成图像视频 — runwayml · 2026-09-12
- 开发者用 GPT-6 Astra 数天做出 45 角色任天堂明星大乱斗网页版 — mattshumer_ · 2026-09-12
- 媒体理论家 Lev Manovich 提出数字艺术「七个世界」新分类法 — matdryhurst · 2026-09-12
- ElevenLabs 发布 Music v2.5:旋律更丰富,全部计划可商用 — aziz4ai · 2026-09-12
- Dreamina 多视角图喂给 GPT-6 Astra,一键生成 360° 交互产品页 — HeyNayeem · 2026-09-12