HUG 用 100 万帧人类视频训练零样本机器人抓握
chris_j_paxton · x · 2026-07-25
RoboPapers 介绍了 HUG(Human Universal Grasping):只用第一视角人类视频来学习机器人抓握。
要点是:
- 团队收集了 100 万帧、27.8 小时 的第一视角人类抓取数据。
- 他们训练了一个 flow-matching 模型来预测人的手部姿态。
- 再把预测出的手姿态 重定向到机器人手 上。
- 这套方法在多种日常场景的 zero-shot 抓握任务 上据称带来明显提升。
帖子还提到本期节目嘉宾包括 @kevinywu、@irmakkguzey、@DandanShan,讨论如何用更容易获取的人类数据替代稀缺的机器人数据。
「具身」频道最新
- 8 美元 ESP32-S3 做出离线实时物体识别摄像头 — Yamapama · 2026-07-25
- SpaceX 称 Starship V3 正在逐飞提升可复用热防护瓦 — XFreeze · 2026-07-25
- Reddit 认为机器人瓶颈更多在 AI 而不是硬件 — ErmingSoHard · 2026-07-25
- 原型 AI 无人机巡场识别并捡起后院狗屎 — brianrkelly · 2026-07-25
- 硬件玩家用 AI 机械工程师设计并打印出棋具 — dee_hw · 2026-07-25
- 访客给机器人的压力测试比团队还更有创意 — DominiqueCAPaul · 2026-07-25