World Labs 发布世界模型 Atlas:文图视频 3D 原生融合,可输出 1440p 视频和显式 3D
thione · x · 2026-09-07
李飞飞旗下 World Labs 发布下一代世界模型 Atlas,一个从零预训练的 omni 模型,原生处理文本、图像、视频和 3D,架构为多模态自回归扩散 transformer,所有输入合并进共享空间上下文,生成时保持 3D 一致性。能力覆盖:
- 相机控制生成:从单张或多张图生成像素级精准相机控制的图像与视频,最长 1 分钟 1440p
- 空间重建:从 1 到几十张输入图重建真实场景,同时输出新视角图像帧与显式 3D,号称超越专用 3D 重建 SOTA
- 时空模拟:从视频建模空间与时间,支持重新构图、Real-to-Sim 机器人工作流
- 文生图:复杂 prompt、文字渲染、360 全景
性能随训练算力提升,Atlas 将驱动 Marble 的后续版本。
「具身」频道最新
- Figure 众包数据网络 Index 公开:每秒处理30分钟视频,已付创作者1500万美元 — adcock_brett · 2026-09-08
- sim2real 一次成功:用仿真机器人快速迭代电影分镜 — alexcovo_eth · 2026-09-08
- 机器人模型公司 Action Intelligence 发布 Continuo,先懂人再造机器人 — thetripathi58 · 2026-09-07
- 具身智能拼完榜单卷落地:部署 Know-how 部署成本砍掉 80% — 智东西 · 2026-09-07
- 宇树 UnifoLM-X2-1.0 让人形机器人首次全自主实时对战 — Distinct-Question-16 · 2026-09-07
- Waymo 正式扩展至伯克利,物理 AI 创业潮在湾区加速 — jfiance · 2026-09-07