DSRL-DCT强化学习让移动操作达100%成功率
rohanpaul_ai · x · 2026-07-05
DSRL-DCT是该框架的强化学习部分,公司称其在移动操作任务上达到100%成功率。做法是冻结预训练的VLA模型,只学习一个更小的噪声选择策略,并用离散余弦变换(DCT)把机器人庞大的动作空间压缩到更小的潜空间。
「具身」频道最新
- 纽约高中拟引入人形机器人遭教师反对 — nordicinst · 2026-07-27
- 新加坡国立大学做出无电子无外部供能软力传感器 — CurieuxExplorer · 2026-07-27
- Chelsea Finn:机器人 RL 的瓶颈是物理 rollout 成本 — ycombinator · 2026-07-27
- 机器人走到冰箱前拿出一瓶啤酒 — Darpinian · 2026-07-27
- 研究者用针织结构复现数字电路 — mtizard · 2026-07-27
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27