Humanoid 公开机器人纠错训练:用强化学习学会从失误中恢复
chris_j_paxton · x · 2026-10-03
人形机器人公司 Humanoid 发布推文线程,展示他们如何教机器人在出错时纠正和恢复——现实世界混乱,机器人不可能总在理想条件下工作。研究员 Chris Paxton 转发并指出核心是部分使用强化学习来避免反复犯同样的错误。线程附有具体演示视频。
「具身」频道最新
- AI2 发布 MolmoMotion:3D 点轨迹预测,机器人抓放成功率提升至 76.3% — k7agar · 2026-10-03
- Neuralink 植入物累计使用超 5 万小时,训练脑机接口基础模型 — DimaZeniuk · 2026-10-03
- 数千仿真并行运行,微型机器人导航策略 10 分钟内训练完成 — bravo_abad · 2026-10-03
- 传 RTX Spark 笔记本 10 月 7 日发布,24GB-128GB 售 1800-2900 美元 — Porespellar · 2026-10-03
- 斯坦福回顾:2018 年称自动驾驶已完成 90%,AI 如何补上最后 10% — StanfordHAI · 2026-10-03
- City Farmers 入选 OpenAI 首批 Codex Physical Builds,做室内种植智能体 — broodsugar · 2026-10-02