用 SAM 2 给机器人 VLA 补上运动感知,成功接住移动瓶子
nikhilaravi · x · 2026-10-08
unnatjain2010 展示了一个实用的改进:在准静态任务中,物体位置信息对 VLA(视觉-语言-动作)模型已足够,但要接住一个正在移动的瓶子,还需要速度与方向信息。团队用冻结的 SAM 2 视频模型从最近几帧中提炼出紧凑的运动线索(motion cue)输入 VLA,使机器人真正完成接瓶任务。SAM 2 模型已开源。
「具身」频道最新
- Jeff Ladish:AI 将复刻工业革命式加速,分歧只在时间尺度 — JeffLadish · 2026-10-08
- 把斑马鱼大脑编译进仿真器,效率达脉冲模型 26 倍,浏览器可跑 — mtizard · 2026-10-08
- 美国开出对外投资新规首张罚单:未申报中国机器人 AI 投资 — pstAsiatech · 2026-10-08
- Palmer Luckey:看好人形机器人,但不打算亲自下场做 — PeterDiamandis · 2026-10-08
- 四足机器人 + 机械臂自动捡垃圾,加长连杆解决够不到的难题 — IsaiahBallah · 2026-10-08
- Microduck 机器人情感动画设计开源:14 种情绪动作与声音组合 — alexcovo_eth · 2026-10-08