R&B-EnCoRe:让VLA模型自主发现有效推理步骤的自监督预训练框架

dl_weekly · x · 2026-07-04

R&B-EnCoRe 是一种新提出的自监督预训练循环方法,专为视觉-语言-动作(VLA)模型设计。与传统固定模板不同,该框架允许模型自主探索并发现哪些推理步骤真正能改善动作预测效果,而非被动遵循预设推理链。

该方法通过自监督信号实现预训练,有望提升机器人控制模型的泛化与推理质量,是VLA训练范式的一次探索性推进。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →