Q-Planning 助机器人策略百次尝试自改进:25%升至80%
animesh_garg · x · 2026-08-28
Q-Planning 是一种基于学习的框架,让大型黑盒机器人策略递归式自我改进。在精细任务中,该策略使机器人在约 30 分钟内(100 次尝试)将成功率从 25% 提升至 80%,无需额外人类数据。
「具身」频道最新
- MIT 新研究实现“回路闭合”抓取,兼顾强固与柔性 — lukas_m_ziegler · 2026-08-28
- Stewart Alsop 将在门多萨举办线下机器人工作坊 — StewartalsopIII · 2026-08-28
- 开源 Animacy:任意人形视频直接驱动机器人动作 — dee_hw · 2026-08-28
- Agent Body Protocol:编码状态可视化 — dee_hw · 2026-08-28
- Autonomous Lamp:有生命感的开源 AI 台灯 — dee_hw · 2026-08-28
- Google 推出 AgentHands:XR 语音助手配手势 — CurieuxExplorer · 2026-08-28