视频生成实测:ref2vid 相比 img2vid 致角色面部细节丢失

Shadow-Games-1909 · reddit · 2026-08-10

一位创作者分享了使用视频生成模型(疑似 H3)的实测体验。在尝试生成长连续场景时,相比使用首尾帧的 img2vid,基于参考图的 ref2vid 模式能更好地处理角色位置并减少背景不匹配的“瞬移”问题。

然而,作者发现 ref2vid 模式会导致明显的画质下降,尤其是角色面部细节的严重丢失。即便使用 4K 放大工具,其画质依然远不及原始静态图像。作者对此提出疑问,探讨基于参考图的生成是否不可避免地会牺牲画质。

所属事件:MiniMax H3视频生成实测:Ref2Vid与I2V画质差异引关注(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →