李飞飞 World Labs 发布世界模型 Atlas
李飞飞联合创办的 World Labs 于 9 月初发布多模态世界模型 Atlas,并三位联合创始人李飞飞、Justin Johnson、Ben Mildenhall 做客 a16z 播客(与 Martin Casado 对谈),详解该模型的技术思路与空间智能路线判断,引发广泛传播。
已确认
- Atlas 的核心能力是「新视角预测」:基于少量输入(如 3 张照片)生成新视角的图像与视频帧,并可将其在 3D 空间中重建,支持像素级相机控制
- 架构思路类比:LLM 基于下一 token 预测,视频模型基于下一帧预测,Atlas 则将预测扩展到新视角/空间维度
- 演示包括用三台 iPhone 复刻「子弹时间」效果;团队称传统 3D 采集成本可降低 50-100 倍
- 多位转发者(ChrisArmstrong、drfeifei 等)均转述同一对谈内容,信息一致:3 张照片即可重建整个房间
为什么重要
- 「新视角预测」被视为可能是继 token prediction 之后的下一个建模范式,是空间智能方向的关键判断
- 若 3D 场景重建成本真如宣称下降 50-100 倍,将大幅降低游戏、影视、机器人仿真等领域的内容生产门槛
2026-09-04 ~ 2026-09-05 · 5 条相关
一手来源
- 【源头】李飞飞团队详解世界模型 Atlas:新视角预测或是下一个 token prediction — a16z · 2026-09-04
- 李飞飞 World Labs 发布世界模型 Atlas:3 张照片即可重建 3D 空间 — theworldlabs · 2026-09-05
另有 3 条近重复转述:Chris_Armstrong · drfeifei · drfeifei