HUG 用 100 万帧人类视频训练零样本机器人抓握
chris_j_paxton · x · 2026-07-25
RoboPapers 介绍了 HUG(Human Universal Grasping):只用第一视角人类视频来学习机器人抓握。
要点是:
- 团队收集了 100 万帧、27.8 小时 的第一视角人类抓取数据。
- 他们训练了一个 flow-matching 模型来预测人的手部姿态。
- 再把预测出的手姿态 重定向到机器人手 上。
- 这套方法在多种日常场景的 zero-shot 抓握任务 上据称带来明显提升。
帖子还提到本期节目嘉宾包括 @kevinywu、@irmakkguzey、@DandanShan,讨论如何用更容易获取的人类数据替代稀缺的机器人数据。
「具身」频道最新
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11
- Swaayatt 演示山区高速自动驾驶:52km/h 过盲弯失控后自稳 — sanjeevs_iitr · 2026-09-11
- AUAR 推移动微型工厂:为每块木板定制生成机器人加工方案 — lukas_m_ziegler · 2026-09-11