真实世界实时RL,机器人百次内掌握任务

svlevine · x · 2026-07-04

该方法的RL部分与普通RL几乎一致,只是把语言指令当作动作。由于优秀的VLA高度可控,这些'动作'表达力很强。团队直接在真实世界中、实时地运行RL,并展示机器人能在不到100个episode内掌握任务。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →