研究者观察:Astra 机器人逐步解析图像理解动作,疑似视觉伺服对应

YuXiang_IRVL · x · 2026-09-14

IRVL 实验室的 Yu Xiang 转发了一段 Astra 机器人执行任务的完整视频(压缩为 2 分钟),并给出技术观察:Astra 似乎能通过分析捕捉到的图像,逐步理解每一个机器人动作的含义。他表示此前未见 VLA(视觉-语言-动作模型)或 WAM 达到这种理解水平,暗示 Astra 可能在图像与动作之间发现了类似视觉伺服(visual-servo)的对应关系。发帖人称后续还会有更多演示放出。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →