新国大提出 RL² 框架:VLA 模型域外任务成功率提升 17%

NationalUniversityofSingapore · hf · 2026-08-03

新加坡国立大学提出 RL² 框架,通过在视觉-语言-动作(VLA)模型的潜空间上训练轻量级离线强化学习策略,在推理时进行自适应组合转向。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →