VLA-JEPA:让机器人聚焦动作的隐空间训练法
jiqizhixin · x · 2026-07-04
中科大、清华、上交团队提出 VLA-JEPA,在隐空间预测未来状态而非像素,避免外观偏置、相机运动等常见问题。在 LIBERO、SimplerEnv 及真实操控任务上,泛化与鲁棒性优于现有 VLA 方法。已公开 arXiv、代码与项目主页。
「具身」频道最新
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11
- Swaayatt 演示山区高速自动驾驶:52km/h 过盲弯失控后自稳 — sanjeevs_iitr · 2026-09-11
- AUAR 推移动微型工厂:为每块木板定制生成机器人加工方案 — lukas_m_ziegler · 2026-09-11