仅用 15 小时视频训练出零样本机器人世界模型
研究人员提出掩码视觉动作(MVA)方法,仅使用 15 小时的单臂机器人视频,就成功训练出一个视频世界模型。该模型展现出强大的跨形态零样本泛化能力,不仅能适应未见过的机器人实体,甚至能泛化应用到猩猩等不同形态的身体上,标志着通用机器人技术取得重要进展。
2026-07-24 ~ 2026-07-25 · 3 条相关
- 只用 15 小时机器人视频训练的世界模型可泛化到新身体 — jon_barron · 2026-07-24
- 15小时机器人视频训练出零样本世界模型 — jbhuang0604 · 2026-07-24
- 掩码视觉动作让视频动作模型跨机身泛化,甚至能覆盖猩猩 — CSProfKGD · 2026-07-25