Anchor-Align:解决 VLA 微调遗忘问题,泛化性大幅提升

_krishna_murthy · x · 2026-08-26

伊利诺伊大学香槟分校等机构提出 Anchor-Align 方法,解决视觉-语言-动作 (VLA) 模型在行为克隆 (BC) 微调后泛化能力退化的问题。

核心问题:直接用 BC 微调 VLA 会覆盖预训练的表征,导致视觉和语义泛化能力丧失;简单的混合图像-文本数据共训练也无法解决语言-动作对齐问题。

解决方案:Anchor-Align 引入两个目标:

效果:在实体 xArm7 机器人上,Anchor-Align 将成功率从 28% 提升至 54%(另一种架构从 37% 提升至 60%)。在仿真中(LIBERO、CALVIN 等基准),该方法在 OOD 扰动、感知鲁棒性和长视界任务上均表现出一致的改进。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →