斯坦福 MobileVISTA:单一基座位姿采集数据,即可泛化到多姿态操作

jiajunwu_cs · x · 2026-10-08

斯坦福大学与丰田研究院(TRI)联合推出 MobileVISTA,一个面向移动操作(mobile manipulation)的数据生成框架。背景问题:端到端操作策略通常在单一机器人基座位姿下采集的示教数据上训练,部署时导航误差带来的几厘米级位姿偏差就会让第一视角观测和末端执行器轨迹偏离训练分布,性能骤降。

核心做法是联合进行两步增强:

与已有方法不同,MobileVISTA 专为相机挂在运动链上的人形等 self-centric 平台设计,无需额外示教采集、也不依赖训练好的生成模型。研究团队在仿真中的人形与双臂任务上验证,并在真实 Galaxea R1 Pro 上测试,发现增强数据训练的策略对测试时未见过的位姿明显更鲁棒,人形平台上收益最大。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →