研究者观察:Astra 机器人逐步解析图像理解动作,疑似视觉伺服对应
YuXiang_IRVL · x · 2026-09-14
IRVL 实验室的 Yu Xiang 转发了一段 Astra 机器人执行任务的完整视频(压缩为 2 分钟),并给出技术观察:Astra 似乎能通过分析捕捉到的图像,逐步理解每一个机器人动作的含义。他表示此前未见 VLA(视觉-语言-动作模型)或 WAM 达到这种理解水平,暗示 Astra 可能在图像与动作之间发现了类似视觉伺服(visual-servo)的对应关系。发帖人称后续还会有更多演示放出。
「具身」频道最新
- 不用 VLA:gpt6 操控 SO-101 机械臂在 MuJoCo 里自动校准分拣乐高 — mishig25 · 2026-09-15
- Waymo 拉斯维加斯自动驾驶服务今日上线 — reed · 2026-09-15
- 自研 Bind 系统将演化发现的结构直接编译为 FPGA 比特流 — chainbornadl · 2026-09-15
- GPT-6 Astra 花 2 小时插好网线,作者指机器人速度仍是瓶颈 — ZeeshanZiaML · 2026-09-14
- 机器人仿真对比实测:Newton 表现扎实,MuJoCo 默认参数偏软可调 solref/solimp — ChongZzZhang · 2026-09-14
- Bryan Johnson 前 CEO/CTO 跳槽脑机接口初创 Sabi,消费级 BCI 拐点将至? — rohanpaul_ai · 2026-09-14