Skild AI 让 Unitree G1 自我对弈 140 年学会踢足球
Distinct-Question-16 · reddit · 2026-09-24
Skild AI 展示其训练的 Unitree G1 人形机器人踢足球:通过自我博弈强化学习,模型在模拟中与「过去的自己」等越来越强的对手累计对弈了相当于 140 年的时间,逐步演化出对抗能力。该案例体现了大规模仿真自博弈在具身机器人技能训练上的效果。
所属事件:Skild AI「Messinator」:140 年模拟自博弈教会机器人踢足球(11 条相关)→
「具身」频道最新
- Schmidhuber:没有 AI 机器人能干水管工的活,屏幕后的 AI 不算真智能 — SchmidhuberAI · 2026-09-24
- 「世界就是安装基础」:人形机器人的被低估优势 — r0ck3t23 · 2026-09-24
- GTSAM 4.3发布:腿足导航、CUDA加速因子图与连续时间轨迹估计 — fdellaert · 2026-09-24
- Workbench 开源:Ambion 内核驱动的多专家硬件工程智能体工作台 — andreisavu · 2026-09-24
- NVIDIA Warp 与 MjWarp 加速机器人仿真与学习工作流教程 — Hugging Face Blog · 2026-09-24
- Deepak Pathak:机器人要靠物理自我博弈通向 AGI — deepakpathak · 2026-09-24