Ref2VA 换脸翻车求助:四张身份照压不过驱动视频里的原人脸

Motion16AI · reddit · 2026-09-20

Reddit 用户 Motion16AI 在使用 MiniMax H3 的 Ref2VA(参考图转视频)做换脸时遇到问题:用四张目标身份照片替换一段 10 秒视频中的女性,渲染完成后输出仍几乎保留原视频中的人物。

配置细节:模型 minimaxh3ref2vaprunedint8convrot、Heretic INT8 文本编码器、736×736 分辨率、243 帧生成后裁至 240 帧/24fps、8 步 MiniMaxH3TurboSampler、参考图取最大尺寸、video shift 12 / audio shift 3、memory-sparse 优化,未用 SAM/遮罩、换脸 adapter 或角色 LoRA。

作者猜测问题可能出在完整参考视频被当作外观条件而非纯运动条件,导致压过身份图;正在考虑改用姿态提取、减少视频参考帧、修正首帧或增加独立追踪换脸阶段等方案,向社区求助。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →