DSRL-DCT强化学习让移动操作达100%成功率

rohanpaul_ai · x · 2026-07-05

DSRL-DCT是该框架的强化学习部分,公司称其在移动操作任务上达到100%成功率。做法是冻结预训练的VLA模型,只学习一个更小的噪声选择策略,并用离散余弦变换(DCT)把机器人庞大的动作空间压缩到更小的潜空间。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →