GRA 论文入选 CoRL 2026:合成机器人视频只该管几何,控制交给真人示教
MikeShou1 · x · 2026-09-05
国大 Mike Zheng Shou 团队的论文《Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos》被 CoRL 2026 接收。核心洞察是不对称保留原则:
- 人转机器人生成视频成本低但无动作标签:生成过程保留了可见的几何(任务的 where),却丢失了控制信号(动作指令,即 how)
- 由此提出 GRA(Geometry-guided Representation Alignment):从源人类视频经姿态估计、重定向、仿真和标定投影,提取未来 2D 末端执行器路径点,作为辅助 2D 头监督 VLA 的视觉主干;动作头只用真实遥操作示教训练
- 动机:VLA 模型需要大规模视频-动作对,但真实遥操作数据稀缺,生成视频是可扩展替代,直接从合成像素恢复伪动作是错误的抽象
论文:arXiv 2606.24448。
「具身」频道最新
- Generalist AI 筹集超 50 万小时真机数据,借 Robinhood 链上发数据赏金 — broodsugar · 2026-09-05
- 从一台到三台不够用:DNA 条形码实验室的 3D 打印产能一周起飞 — generativist · 2026-09-05
- 特斯拉 Cybercab 无人出租车在奥斯汀正式发布 — xfour · 2026-09-05
- IFA2026 千家中企创纪录参展,人形机器人成全场主角 — 智东西 · 2026-09-05
- 创业者自曝:机器人数据公司已成最饱和创业方向 — arian_ghashghai · 2026-09-05
- 真人遥控高达机器人实机演示视频曝光 — i_bioloid · 2026-09-05