AtlasVLA:引入持久化记忆的具身视觉-语言-动作模型

CASIA-IVA-Lab · hf · 2026-08-13

中科院团队提出 AtlasVLA,旨在改进视觉-语言-动作(VLA)模型在具身智能中的表现。

传统模型多为被动反应式控制,AtlasVLA 引入了持久化的“世界-自我”状态记忆机制,使模型能够进行主动推理。该架构仅需单个腕部摄像头,即可实现鲁棒的长时序机械臂操作任务。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →