Adobe Wonder 把图片变成可控相机的视频世界模型
adobe · hf · 2026-07-29
Adobe Research 和 Johns Hopkins 提出了 Wonder,一个面向实时、可由相机控制的通用视频世界模型。它可以从一张图或一段条件视频出发,构建一个可交互的“可玩世界”,用户能通过移动镜头探索未见区域,并在长时间跨度里回看已见内容。
论文的关键设计包括:
- 密集坐标场式的相机条件:把镜头运动直接转成视觉证据。
- 稀疏注意力记忆机制:在长上下文里快速检索相关信息。
- 蒸馏流程修正:增强学生模型对控制信号的服从度,同时保留多样性和长期记忆。
系统可在 16 FPS 下生成分钟级视频,也支持对已有动态场景做实时重拍式生成。
所属事件:Adobe联合高校推出实时3D世界模型Wonder(3 条相关)→
「多模态」频道最新
- 创作者展示 AI 生成《Odyssey》微电影首集 — DavidmComfort · 2026-07-30
- Adobe与约翰霍普金斯大学发布Wonder:实时可交互3D世界模型 — yuyinzhou_cs · 2026-07-30
- 粉丝用 AI 为 Skrillex 单曲《Kyoto》制作 MV — Procyon87 · 2026-07-30
- nano banana pro 实战:生成 3x3 电影级分镜 — techhalla · 2026-07-30
- 创作者用 AI 重现真实故事,视频生成质量惊艳 — Daniel_Ai_VFX · 2026-07-30
- 网友使用 Seedance 2 模型全流程制作音乐 MV — Old_Mode_7649 · 2026-07-30