World Labs 发布全模态世界模型 Atlas:原生支持文本图像视频3D

theworldlabs · x · 2026-09-24

World Labs 正式发布下一代世界模型 Atlas,一个为空间智能打造的 omni(全模态)世界模型,从零预训练,原生处理文本、图像、视频与 3D。架构上是多模态自回归扩散 Transformer,所有输入合并进共享空间上下文,生成与已见内容在 3D 上保持一致的结果。

主要能力包括:

Atlas 随训练算力增加性能持续提升,团队预期该 scaling 趋势可延续。它将驱动未来版本的 Marble 及其他产品,beta 已开放报名。

所属事件:Atlas 3D 生成工具 Chisel 开启 Beta:框出方块即可生成世界(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →