ECCV 2026:DreamWorld 几何引导视频生成实现 3D 一致性
jiqizhixin · x · 2026-08-25
DreamWorld 是一种被 ECCV 2026 接收的视频生成新方法。它将视频生成分为两个阶段:首先使用预训练 3D 基础模型生成 3D 几何特征,然后将这些结构表示输入外观扩散模型以渲染最终的 RGB 帧。这种“先几何后外观”的设计赋予了视频模型显式的 3D 基础,避免了模型在生成像素时隐式推理空间的困难。实验结果表明,该方法在 RealEstate10K、Tanks-and-Temples 和 WorldScore 基准测试中取得了最先进的分数,特别是在大视角变化场景下表现出色,解决了竞争方法中常见的形状扭曲和跨视图不一致问题。
「多模态」频道最新
- 阿里发布Swift-Image:6B参数统一文生图与编辑模型 — HaktanSuren · 2026-08-25
- 阿里发布 swift-image 6B:统一图文编辑模型 — bdsqlsz · 2026-08-25
- Civitai 与 Krea2 的 LoRA 合并技巧探讨 — EasternAverage8 · 2026-08-25
- 求荐最佳低成本视频数字人模型 — CelebrationBoth9537 · 2026-08-25
- WAN 3.0 生成展示:多镜头调度与物理模拟 — minchoi · 2026-08-25
- 网友用 MiniMax H3 低成本 I2V/R2V 流程做出完整动漫预告片 — Beginning_Tip300 · 2026-08-25