RL2-VLA:视觉语言动作模型的自适应 RL 组合转向与测试时扩展

rsasaki0109 · x · 2026-08-18

介绍 RL2-VLA 方法:面向视觉-语言-动作模型的自适应强化学习潜空间组合转向。核心思路是先依赖基础 VLA 的采样靠近目标物体,再在预判到失败时自适应地施加 RL 组合转向,使动作向成功状态多样化探索,并利用测试时扩展提升表现。

所属事件:RL²-VLA 用强化学习提升机器人操作成功率(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →