同次生成保空间布局:实测视频生成中的场景位置一致性

Tokyo_Jab · reddit · 2026-09-03

Reddit 用户 TokyoJab 分享了一项视频生成的「位置一致性」测试:把多个镜头放在同一次生成中完成时,latent space 对场景布局保持得相当好——即使寺庙一度移出画面,其位置和细节在切回时仍能延续。

关键发现是:这类一致性在需要分次生成的 extension 工作流中无法实现,因此作者建议要维持空间连续性,应尽量把所有镜头放在单次生成里一口气完成。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →