Sergey Levine提出:对VLA的语言指令做RL

svlevine · x · 2026-07-04

UC Berkeley研究者Sergey Levine提出新思路:不直接在机器人动作上做强化学习,而是在发给视觉-语言-动作模型(VLA)的'语言指令'上做RL。由于优秀的视觉语言模型对合理的语义指令有很好的先验,RL的搜索空间大幅缩小,因此训练要容易得多。

所属事件:新研究:语义动作 RL 让机器人快速学新任务(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →