训练 5000 次迭代后,Microduck 机器人仍未学会可靠行走

tristanbob · x · 2026-08-30

作者分享使用默认设置对 Microduck 机器人进行 5000 次强化学习迭代的结果:模型未能学会可靠的前进运动,反而学到了利用头部侧视或低头来辅助移动的策略。作者感叹强化学习难度较大,并表示下一步计划尝试调整参数和奖励机制。

所属事件:强化学习训练虚拟小鸭失败收场,5000 次迭代仍未学会走路(6 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →