只用 15 小时机器人视频训练的世界模型可泛化到新身体
jon_barron · x · 2026-07-24
研究者只用 15 小时的单臂机器人视频,就训练出了一个 视频世界模型。
- 它可以 零样本泛化 到没见过的实体形态,甚至包括 orangutans。
- 模型还学到了一个额外能力:只要给出你想要的物体运动,它就能合成出实现这种运动所需的机器人动作。
- 核心做法是把动作表示成 masked video。
这条信息的重点不只是“数据少”,而是该方法在具身迁移和动作生成上表现出较强的泛化能力。
「具身」频道最新
- VTAP Gripper 试图补上夹爪到灵巧手的空缺 — YunzhuLiYZ · 2026-07-24
- DoorDash 称机器人和无人机押注已持续八年 — garrytan · 2026-07-24
- HP 联合 AMD 推出面向本地模型和多智能体的 AI 工作站 — gaganghotra_ · 2026-07-24
- 具身 AI 要学会真实约束,得先吸收多年手艺经验 — Exp_Mark · 2026-07-24
- 特斯拉 robotaxi 乘客称坦帕体验顺滑,像到了拐点 — downingARK · 2026-07-24
- REK Shop 转型机器人格斗,清仓 Unitree 与 Booster 等现货 — cixliv · 2026-07-24