World Labs 发布全能世界模型 Atlas:手机随手拍即可重建三维场景换机位重拍
FinanceYF5 · x · 2026-09-02
World Labs 发布新一代世界模型 Atlas,定位为面向空间智能的全能(omni)世界模型,从零预训练,原生支持文本、图像、视频与 3D 输入,架构为多模态自回归扩散 Transformer,所有输入汇入共享空间上下文并保持 3D 一致性。
核心能力包括:
- 相机控制生成:从单张或多张图像生成图片/视频,机位控制到像素级,最长可输出 1 分钟 1440p 视频
- 空间重建:从 1 到数十张输入图像重建真实场景,输出新视角画面与显式 3D 结果,超越专门的 3D 重建 SOTA 模型
- 时空模拟:对输入视频建模空间与时间,可重新取景制造戏剧效果,并支持机器人 Real-to-Sim 工作流
- 图像生成:文生图与 360 全景,可遵循复杂提示词、渲染文字与多种风格
Atlas 随训练算力增加性能持续提升,未来将为 Marble 等产品提供动力。演示中最抓人的场景:仅用三台三脚架手机拍摄的画面,Atlas 能重建完整场景并从原本不存在的机位重新构图「重拍」视频——视频生成正从修改画面走向真正理解三维空间。
所属事件:World Labs 发布全模态世界模型 Atlas(53 条相关)→
「多模态」频道最新
- Fable 5.1 生成成本仅733美元,3D模型仍具实用价值 — Angaisb_ · 2026-09-02
- 利用 ComfyUI 与 DLSS 5 制作《暗黑4》过场动画 — Choidonhyeon · 2026-09-02
- Midjourney H3 提示技巧:简化指令提升遵循度 — robertwellesley · 2026-09-02
- Minimax H3 生成「冷血蟾蜍」短片:质感扎实画风带感 — Long_March_7664 · 2026-09-02
- MiniMax H3 实拍级地貌短片爆火:不存在的「国家地理」取景地全靠生成 — techhalla · 2026-09-02
- AI 短片创作:保持流畅感与夸张视觉的平衡 — Straight-Rub1255 · 2026-09-02