MotionVLA 入选 CoRL 2026:让机器人记住运动而非帧

yshan2u · x · 2026-09-08

华中科技大学 Xinggang Wang 团队的 MotionVLA 被 CoRL 2026 接收,论文已挂 arXiv(2606.08288)。

核心主张:VLA 模型该记住的是「运动」,而不是一帧帧画面。现有方法给模型喂历史帧、深度或 4D 特征来解决长时程操作的歧义,但当注入的证据不满足运动一致性时,会引入几何漂移、时序线索碎片化和动作生成不稳定。

方法:

在仿真基准和初步真机实验中,MotionVLA 提升了长时程操作表现,动作执行更平滑直接。结论:有效的 VLA 记忆关键不是堆更多 4D 上下文,而是提供可用于控制的运动一致证据。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →