给机器人看段人类视频就能学新任务,Zero-WAM 免微调泛化
deepakpathak · x · 2026-08-28
港科大(广州)等团队发布 Zero-WAM:把人类示范视频当作 in-context prompt,模型观察场景应如何演变后直接生成机器人动作,无需针对具体任务微调。
- 为规模化训练,团队构建 HumanGen 数据集,含 74.2k 生成的人-机器人配对、覆盖 8.6k 个任务。
- 在 7 个未见的 RoboTwin 任务上成功率达 47.0%,比最强视频-动作基线高 29.5 个百分点。
- 已验证真机迁移:未见的多物体、长时程与插入类任务。
核心动机:语言只能说「把这个放那儿」,视频还能展示路径、时序、接触顺序和目标的具体样子。
所属事件:Zero-WAM 让机器人看人类视频即学会新任务(2 条相关)→
「具身」频道最新
- 微型机器人 Microduck 演示机载 ToF 传感器监控工具 — viksit · 2026-08-28
- Lumos 机器人已投入工厂产线:日复一日做真事 — chris_j_paxton · 2026-08-28
- AI 智能体让机器人仿真训练更易用 — chris_j_paxton · 2026-08-28
- 2 岁女儿拥有 6 个机器人,未来人机共存将成常态 — chris_j_paxton · 2026-08-28
- U-BOT 机器人机身缩至 250mm,耗时 11.5 小时打印完成 — _Stocko_ · 2026-08-28
- 手机浏览器里跑真机器人:Microduck AR 把 RL 策略装进 AR — multimodalart · 2026-08-28