实测 MiniMax 视频模型:仅用 2 张图完成复杂武打场景背景替换
illumi_nation25 · reddit · 2026-08-14
作者分享了使用 MiniMax 视频生成模型(MMH3 REF2V)进行高难度视频背景与场景替换的实测工作流。实验表明,通过仅使用 2 张实拍的照片作为参考图,模型能够成功替换一段 12 秒复杂武打视频的背景,且较好地保留了原视频的人物动作、光影和运镜轨迹。
关键工作流与经验:
- 硬件与软件:使用 RTX 5090 运行,结合 DaSiWa MiniMax H3 Workflows,并在 DaVinci Resolve 中进行后期拼接。
- 分块生成策略:由于模型难以一次性完美匹配长动作,作者将 12 秒的长视频拆分为两个 6 秒的短视频分别生成,最后挑选最佳片段剪辑。
- 提示词结构:原帖详细分享了一套结构化的提示词模板,明确定义了视频素材(提供运镜、动作、音频)与环境素材(提供目标背景)的保留与替换规则,实现了精准的视觉控制。
所属事件:MiniMax H3 支持参考视频加提示词编辑(3 条相关)→
「多模态」频道最新
- 实测 Higgsfield Seedance 模型:精准还原吉他指法 — R34vspec · 2026-08-14
- AI生成视频逼真到以假乱真,网友直呼看不出 — heypearlai · 2026-08-14
- 微软 MAI-Image 图像编辑实测:精准擦除模糊手指不留痕迹 — AmyKateNicho · 2026-08-14
- Midjourney V8.2 新风格实测:附 sref 提示词 — azed_ai · 2026-08-14
- MiniMax H3 模型生成逼真核爆效果视频 — VasaFromParadise · 2026-08-14
- 用妻子照片训练 LoRA 结合 Seedance 生成视频 — alecubudulecu · 2026-08-14