用 MiniMax + ComfyUI 给老电影加新场景,角色声音一致性仍是难点
StudentLeather9735 · reddit · 2026-09-06
一位创作者分享了用 MiniMax 视频模型在电影《赌城风云》(Casino)中插入新场景的实验:通过 ComfyUI 工作流为每个角色输入参考音频和图像,尝试保持演员形象与声音的一致性,并公开了完整 workflow JSON。
目前的主要问题是即便给了清晰的参考音频,角色声音仍经常漂移,需要反复尝试不同 seed 才能得到正确配音,在 RTX 3060 上非常耗时;剪辑部分作者也更倾向交给 DaVinci 做后期。他在征求更稳定的场景替换工作流建议。
「多模态」频道最新
- GPT Image 手工微缩景观提示词模板,一键生成城市立体书画面 — SimplyAnnisa · 2026-09-06
- 用户实测:Astra 出图比 Sol 更忠实执行提示词,Grok 体验最差 — Linahuaa · 2026-09-06
- 博主分享一条梦境风格图像生成提示词 — umesh_ai · 2026-09-06
- Codex 一句「写首协奏曲」,5 分钟产出乐谱、动画与真实乐器音轨 — mhmazur · 2026-09-06
- 单色高调人像摄影 Prompt 分享:黑白极简剪影风 — azed_ai · 2026-09-06
- 导演丹尼·博伊尔用 AI 只做 30 秒镜头,划出使用边界 — taherdhanera · 2026-09-06