World Labs 发布 Atlas 世界模型:文本图像视频 3D 全模态统一生成

gowthami_s · x · 2026-09-02

World Labs 发布新一代 omni 世界模型 Atlas,从零预训练,原生处理文本、图像、视频和 3D,架构为多模态自回归扩散 Transformer,把所有输入整合进共享空间上下文,生成时与已见内容保持 3D 一致。官方称其性能随训练算力扩展持续提升。

核心能力包括:

Atlas 将驱动未来版本的 Marble 等产品,目前已开放 waitlist。实测者称其图像与全景生成效果惊艳。

所属事件:李飞飞 World Labs 发布多模态世界模型 Atlas(20 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →