实测多款音乐生成模型:声音克隆唱首歌仍无人做到
why_not_zoidberg_82 · reddit · 2026-09-11
发帖人想知道能否用声音克隆参考让 AI 唱歌,并实测了多款工具:
- LTX 2.3:能生成带背景音乐的简单歌曲,但不支持声音参考/克隆;其 In-Context LoRA 虽可按文本提示克隆声音,但唱不出完整的歌,更像没有配乐干唱歌词。
- MiniMax H3 ref2va:接受声音参考但无法生成音乐,效果等于把歌词念出来。
- AceStep 1.5:接受音乐参考但不能作为克隆来源,也不支持声音参考。
结论:目前声音克隆 + 歌曲生成仍然没有成熟方案,发帖人询问是否有步骤操作不当。
「多模态」频道最新
- 谷歌携 41 篇论文亮相 ECCV 2026,涉视频空间理解等研究 — ymatias · 2026-09-11
- AI Movie Studio 2 预览:3D 镜头预演省视频生成额度,已开源 — purecharisma2020 · 2026-09-11
- 创作者用 AI 为自己的翻唱歌曲生成完整 MV — sofiafarhan · 2026-09-11
- 用 LoRA 同时驱动图像、视频与 3D 生成:Three.js Conf 演讲引关注 — OdinLovis · 2026-09-11
- 用户反馈 MiniMax H3 图生视频偏写实,卡通风格难以保持 — DeltaWaffleSyrup · 2026-09-11
- 环球音乐与 ElevenLabs 达成多年授权协议,将推正版 AI 音乐创作平台 — lukeharries · 2026-09-11