一个策略控 200+ 种机器人:通用运动控制策略 γ₀ 开放征集
GeorgiaChal · x · 2026-10-02
Nico Bohlinger 团队发布通用运动控制 RL 策略 γ₀(gamma-zero):用一个策略覆盖数百万种随机化的机器人形态(embodiments),底层来自 200 多个机器人模型且仍在增长。
- 训练时不仅随机化几何结构,还随机化动力学与执行器(actuation)属性
- 目标是跨大量不同本体的通用运动控制,而非单一机器人专用策略
- 形态库持续征集:有有趣的机器人平台或 URDF 可在 10 月 15 日前贡献
Georgia Chal 评价这是横跨海量机器人形态的大规模训练工程。
「具身」频道最新
- Shield AI 借鉴 Tesla 仿真路线,收购 Aechelon 剑指 AI 飞行员训练 — BrettKrieger12 · 2026-10-02
- OpenAI 送出 Codex Micro 实体设备,开发者晒开箱 — OpenAIDevs · 2026-10-02
- 博主看多特斯拉:Cybercab 注册量持续攀升,股价未反映进展 — JOBhakdi · 2026-10-02
- Rhoda 机器人已可高自主完成电子厂料盘拆包扫描码放等真实客户任务 — vincesitzmann · 2026-10-02
- IROS 最惊艳机器人演示:Digit 从箱中取物搬运,成功率约 80-90% — jonstephens85 · 2026-10-02
- HuGo 方法用 LLM/VLM 自动生成验证机器人策略,无需示范和奖励工程 — m_wulfmeier · 2026-10-02