Ref2VA 换脸翻车求助:四张身份照压不过驱动视频里的原人脸
Motion16AI · reddit · 2026-09-20
Reddit 用户 Motion16AI 在使用 MiniMax H3 的 Ref2VA(参考图转视频)做换脸时遇到问题:用四张目标身份照片替换一段 10 秒视频中的女性,渲染完成后输出仍几乎保留原视频中的人物。
配置细节:模型 minimaxh3ref2vaprunedint8convrot、Heretic INT8 文本编码器、736×736 分辨率、243 帧生成后裁至 240 帧/24fps、8 步 MiniMaxH3TurboSampler、参考图取最大尺寸、video shift 12 / audio shift 3、memory-sparse 优化,未用 SAM/遮罩、换脸 adapter 或角色 LoRA。
作者猜测问题可能出在完整参考视频被当作外观条件而非纯运动条件,导致压过身份图;正在考虑改用姿态提取、减少视频参考帧、修正首帧或增加独立追踪换脸阶段等方案,向社区求助。
「多模态」频道最新
- Qwen Image 2.1 抢先实测:7B 参数出图不错但有噪点 — 13baaphumain · 2026-09-20
- 实测 Gemini Live 实时语音:转写+推理+工具调用全声控 — AI_Andrew · 2026-09-20
- YuE2 翻唱调参指南:改这两组 CFG/temp,出片质量大幅提升 — LilBrownBebeShoes · 2026-09-20
- rigged + ImageGen 关键帧:一条兔子 3D 动画全流程无需手工关键帧 — Dimillian · 2026-09-20
- Grok Imagine 生成弓箭手短片,Topaz 放大后效果惊艳 — creatoroff · 2026-09-20
- 运营四年的众包免费推理网络 AI Horde 发布全新界面与后端 — dbzer0 · 2026-09-20