LIT 方法破解 VLA 视觉-动作捷径,提升机器人泛化

DJiafei · x · 2026-09-11

作者提出 Latent Interface Training(LIT):VLA 和世界动作模型(WAM)的动作专家可能学到视觉-动作捷径,损害训练分布之外的泛化。LIT 的思路是「先学会动作,再学会用视觉」。详见同线程后续及项目页。

所属事件:LIT 两阶段训练破解机器人视觉-动作捷径(4 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →