Skild 用自我博弈教人形机器人踢球,140 模拟年无人类示范
lukas_m_ziegler · x · 2026-09-29
Skild AI 用自我博弈(self-play)训练人形机器人踢足球,高级行为不依赖手工奖励和人类示范。
经过相当于 140 年的模拟自我对弈后,机器人自己学会了带球过人、护球和抢断,随后策略成功迁移到真实机器人上。
背后的逻辑:模仿学习把机器人的能力上限锁死在人类水平,而自我博弈正是 AlphaGo 击败人类的方法,Skild 认为这是通往物理 AGI 的路径。
「具身」频道最新
- 递归经验蒸馏让机器人操作成功率从 37.3% 提升至 64.0% — SeoulNatlUniv · 2026-09-29
- 清华团队人形机器人羽毛球上线:30 分钟动数据学会正反手与跳杀回球 — ChongZzZhang · 2026-09-29
- Bose 回归有线降噪耳机:99 美元靠 USB-C 供电,告别电池砖 — aakashgupta · 2026-09-29
- 宇树发布 Dex5-1 灵巧手:22 自由度全后驱,售价 6500 美元起 — lukas_m_ziegler · 2026-09-29
- Niantic 开放 100 个 3D 真实场景库供机器人仿真训练,Vesoma 携人形机器人亮相 — lukas_m_ziegler · 2026-09-29
- 前 DeepMind 研究总监创立 Vesoma,人形机器人 2027 年亮相 — lukas_m_ziegler · 2026-09-29