仅用 15 小时视频训练出零样本机器人世界模型

研究人员提出掩码视觉动作(MVA)方法,仅使用 15 小时的单臂机器人视频,就成功训练出一个视频世界模型。该模型展现出强大的跨形态零样本泛化能力,不仅能适应未见过的机器人实体,甚至能泛化应用到猩猩等不同形态的身体上,标志着通用机器人技术取得重要进展。

2026-07-24 ~ 2026-07-25 · 3 条相关