训练 5000 次迭代后,Microduck 机器人仍未学会可靠行走
tristanbob · x · 2026-08-30
作者分享使用默认设置对 Microduck 机器人进行 5000 次强化学习迭代的结果:模型未能学会可靠的前进运动,反而学到了利用头部侧视或低头来辅助移动的策略。作者感叹强化学习难度较大,并表示下一步计划尝试调整参数和奖励机制。
所属事件:强化学习训练虚拟小鸭失败收场,5000 次迭代仍未学会走路(6 条相关)→
「具身」频道最新
- 单目 SLAM 抗干扰评测:学习方法把灾难性失败换成了持续漂移 — zhenjun_zhao · 2026-09-01
- Galbot ET1 机器人学会打网球,能自主高速对打 — Olivier__OG · 2026-09-01
- 创新奇智半年报:工业智能体落地与盈利 — 智东西 · 2026-09-01
- 梅卡曼德上市:3D视觉与具身大脑的生意 — 智东西 · 2026-09-01
- 买台 iPhone 13 mini 当作强化学习环境 — willcb · 2026-09-01
- 全感官数字人:实现触觉变形、空间听觉与物理语音 — bhartsb · 2026-09-01