只用 15 小时机器人视频训练的世界模型可泛化到新身体
jon_barron · x · 2026-07-24
研究者只用 15 小时的单臂机器人视频,就训练出了一个 视频世界模型。
- 它可以 零样本泛化 到没见过的实体形态,甚至包括 orangutans。
- 模型还学到了一个额外能力:只要给出你想要的物体运动,它就能合成出实现这种运动所需的机器人动作。
- 核心做法是把动作表示成 masked video。
这条信息的重点不只是“数据少”,而是该方法在具身迁移和动作生成上表现出较强的泛化能力。
所属事件:仅用 15 小时视频训练出零样本机器人世界模型(3 条相关)→
「具身」频道最新
- 亚马逊谷歌卖出6亿台音箱,AGI 时代为何无人再造智能音箱 — julianlehr · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11