MiniMax H3 Ref2V 实战:单链路实现换脸、姿态迁移与多主体混合
TBG______ · reddit · 2026-09-01
作者在先前唇形同步工作流基础上,用 MiniMax H3 的 Ref2V 能力搭建了一条通用编辑链路,可以把一段参考视频当作「表演母带」(提供动作、节奏、镜头),再由参考图片与音频驱动角色外貌与身份。
已验证的组合包括:
- 音乐视频姿态迁移
- 单角色替换(主演换成参考角色)
- 多主体混合:身份互换、多角色同步/异步表演、把参考视频中的角色抽到图片参考场景里再添加新角色等
关键实践细节:
- 全流程通过单一 H3 链路完成,混合 ref-image + ref-video + ref-audio,用结构化提示词把身份(图片)、表演(视频)、约束(文本)分开描述
- 帖中给出了主体定义模板写法,如 <Subject 1> 严格 100% 匹配 <Picture 1> 的外形、材质、logo 等并全程保持可辨识
- 代价不低:3 秒 2MP 规格的参考视频条件化 VRAM 用量超过 40GB,且低于 2MP 细节和动作迁移质量会明显下降
- 作者强调这只是众多方案之一,尚不完美
所属事件:MiniMax H3 社区工作流涌现:换脸、姿态迁移与多镜头管理(3 条相关)→
「多模态」频道最新
- Clip Bot:从 YouTube 视频中快速提取带字幕的精彩片段 — CodeByPoonam · 2026-09-01
- Worldfold 引入体积雾光散射,M1 Mac 也能跑 — jamestagg · 2026-09-01
- Runway Omni 1.1 Flash实测:首尾帧控制与场景扩展增强 — jnack · 2026-09-01
- 波多黎各 3D 扫描:1.39GB 高斯泼洒 WebGPU 渲染 — willeastcott · 2026-09-01
- 变形金刚飞机AI视频:创作者分享迄今最佳作品 — Such_Highlight_3941 · 2026-09-01
- LFM2.5-VL-3B 医疗实测:跨时间分析皮肤病灶变化 — helloiamleonie · 2026-09-01