VLA-JEPA:让机器人聚焦动作的隐空间训练法

jiqizhixin · x · 2026-07-04

中科大、清华、上交团队提出 VLA-JEPA,在隐空间预测未来状态而非像素,避免外观偏置、相机运动等常见问题。在 LIBERO、SimplerEnv 及真实操控任务上,泛化与鲁棒性优于现有 VLA 方法。已公开 arXiv、代码与项目主页。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →