TANGO 全身 VLA 模型让人形机器人零样本穿越杂乱环境

CoRL 论文 TANGO 提出面向人形机器人导航的全身视觉-语言-动作框架,给定自然语言指令和第一视角 RGB 观测,直接预测 29 自由度关节动作,协调手臂、躯干与步态。该模型全部训练仅依赖仿真数据,无需真实世界数据采集,即可让人形机器人零样本穿越杂乱室内环境。

2026-09-09 ~ 2026-09-09 · 2 条相关