用 SAM 2 给机器人 VLA 补上运动感知,成功接住移动瓶子

nikhilaravi · x · 2026-10-08

unnatjain2010 展示了一个实用的改进:在准静态任务中,物体位置信息对 VLA(视觉-语言-动作)模型已足够,但要接住一个正在移动的瓶子,还需要速度与方向信息。团队用冻结的 SAM 2 视频模型从最近几帧中提炼出紧凑的运动线索(motion cue)输入 VLA,使机器人真正完成接瓶任务。SAM 2 模型已开源。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →