用外绘思路控制 MiniMax H3 姿态,比例不一致也能跑通
bbaudio2024 · reddit · 2026-09-15
作者分享了一个控制 MiniMax H3 视频角色动作的替代思路。常规 fun controlnet 方案需要先把控制视频转成 open pose,处理耗时长,且人物身体比例不一致时效果差;同时 H3 自带的参考视频方式采样时间明显更长、效果常不理想。
作者的解法是借用当年用 Flux controlnet 做一致性角色的「外绘」思路:把参考视频当作输入,对视频进行 outpainting 扩展,配合合适的 prompt,让扩展部分自然生成想要的结果。作者用自建节点 ComfyUI-MMH3-UltimateExtend 验证,即使人物比例差异较大也能保持动作相对一致。缺点是需要更宽的视频画幅容纳输入视频,显存消耗更大。工作流已贴在 pastebin。
「多模态」频道最新
- Gradium 推出 Voice Designer:文字描述秒级生成可用 TTS 音色 — mattturck · 2026-09-16
- Runway CEO:不再留一手,公开爆款视频全部工作流与秘密 — c_valenzuelab · 2026-09-16
- Seedance 2.5 恐怖片实测惊艳,作者押注中国赢下视频 AI — VraserX · 2026-09-16
- 百万级 Danbooru 标签清洗数据集开源,Apache 2.0 协议可商用 — Grio43 · 2026-09-16
- MiniMax H3 生态速览:官方 Skills 文件夹、ComfyUI 节点与四步生成引擎 — optimisticalish · 2026-09-16
- Poolday 融资 1100 万美元,推出能真正读懂软件的 AI 视频 Agent — aryanXmahajan · 2026-09-16