R&B-EnCoRe:让VLA模型自主发现有效推理步骤的自监督预训练框架
dl_weekly · x · 2026-07-04
R&B-EnCoRe 是一种新提出的自监督预训练循环方法,专为视觉-语言-动作(VLA)模型设计。与传统固定模板不同,该框架允许模型自主探索并发现哪些推理步骤真正能改善动作预测效果,而非被动遵循预设推理链。
该方法通过自监督信号实现预训练,有望提升机器人控制模型的泛化与推理质量,是VLA训练范式的一次探索性推进。
「具身」频道最新
- 纽约高中拟引入人形机器人遭教师反对 — nordicinst · 2026-07-27
- 新加坡国立大学做出无电子无外部供能软力传感器 — CurieuxExplorer · 2026-07-27
- Chelsea Finn:机器人 RL 的瓶颈是物理 rollout 成本 — ycombinator · 2026-07-27
- 机器人走到冰箱前拿出一瓶啤酒 — Darpinian · 2026-07-27
- 研究者用针织结构复现数字电路 — mtizard · 2026-07-27
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27