斯坦福 MobileVISTA:单一基座位姿采集数据,即可泛化到多姿态操作
jiajunwu_cs · x · 2026-10-08
斯坦福大学与丰田研究院(TRI)联合推出 MobileVISTA,一个面向移动操作(mobile manipulation)的数据生成框架。背景问题:端到端操作策略通常在单一机器人基座位姿下采集的示教数据上训练,部署时导航误差带来的几厘米级位姿偏差就会让第一视角观测和末端执行器轨迹偏离训练分布,性能骤降。
核心做法是联合进行两步增强:
- 对第一视角视觉观测做生成式扰动,模拟不同基座位姿下的画面;
- 将动作重定向以补偿基座位姿变化。
与已有方法不同,MobileVISTA 专为相机挂在运动链上的人形等 self-centric 平台设计,无需额外示教采集、也不依赖训练好的生成模型。研究团队在仿真中的人形与双臂任务上验证,并在真实 Galaxea R1 Pro 上测试,发现增强数据训练的策略对测试时未见过的位姿明显更鲁棒,人形平台上收益最大。
「具身」频道最新
- NEEDLEwork 缝合次优与失败轨迹,重写机器人训练数据 — SongShuran · 2026-10-08
- Jeff Ladish:AI 将复刻工业革命式加速,分歧只在时间尺度 — JeffLadish · 2026-10-08
- 把斑马鱼大脑编译进仿真器,效率达脉冲模型 26 倍,浏览器可跑 — mtizard · 2026-10-08
- 美国开出对外投资新规首张罚单:未申报中国机器人 AI 投资 — pstAsiatech · 2026-10-08
- Palmer Luckey:看好人形机器人,但不打算亲自下场做 — PeterDiamandis · 2026-10-08
- 用 SAM 2 给机器人 VLA 补上运动感知,成功接住移动瓶子 — nikhilaravi · 2026-10-08