ECCV 2026:DreamWorld 几何引导视频生成实现 3D 一致性

jiqizhixin · x · 2026-08-25

DreamWorld 是一种被 ECCV 2026 接收的视频生成新方法。它将视频生成分为两个阶段:首先使用预训练 3D 基础模型生成 3D 几何特征,然后将这些结构表示输入外观扩散模型以渲染最终的 RGB 帧。这种“先几何后外观”的设计赋予了视频模型显式的 3D 基础,避免了模型在生成像素时隐式推理空间的困难。实验结果表明,该方法在 RealEstate10K、Tanks-and-Temples 和 WorldScore 基准测试中取得了最先进的分数,特别是在大视角变化场景下表现出色,解决了竞争方法中常见的形状扭曲和跨视图不一致问题。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →