实测发现:AI视频配音无法同时用两段参考音频
Portable_Solar_ZA · reddit · 2026-08-29
一位参加 Comfy Sync 比赛的开发者经过大量测试发现,目前的音频生成模型无法同时接受两段参考音频并让它们在同一时刻共存:同时给参考人声和参考音乐,音乐会在人声出现时消失或变得几乎不可闻、含糊不清。
可行的做法是「1 参考音频 + 1 模型生成」:参考人声 + 模型生成音乐,或模型生成人声 + 参考音乐,两者叠加可正常工作。他原计划用自定义旁白加参考音乐做预告片,最终只能放弃这一组合。
「多模态」频道最新
- APOB AI 助力生成逼真 AI 网红视频,Seedance 2.5 挑战 30 秒 Vlog — aftahi_ai · 2026-08-29
- Seedance 2.5 生成超写实怀旧视频,参数全公开 — eyishazyer · 2026-08-29
- Krea 2 安全过滤疑似出现过度矫正现象 — Only_Voice569 · 2026-08-29
- Midjourney V8.2 新风格参数 --sref 3148902816 — azed_ai · 2026-08-29
- AI 生成特朗普与威尔·史密斯在跳舞游戏中的对决 — fiftypence · 2026-08-29
- AI 生成短片《Outlaw Quartet》 — humboldtsammo · 2026-08-29