机器人行走实验加了新奖励,但仍有 80% 失败率

carlosdponx · x · 2026-08-04

作者在一个行走机器人/控制实验里做了几项改动:

他表示演示“有时看起来不错”,但其实仍有 80% 的失败率,大多数时候到不了目标。当前训练跑在 RTX 4090 上,这个模型一次只能放下 128 个并行环境,后面还会继续加实验和算力。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →