华科等团队推出 AdaRoboVLG,让机器人按语境决定怎么抓杯子
jiqizhixin · x · 2026-10-03
华中科技大学、北京大学与 Keenon Robotics 提出 AdaRoboVLG,面向视觉-语言-抓取(VLG)任务:机器人要根据自然语言和语境决定抓取方式——同一个杯子,倒水进水槽时抓把手合适,递给别人则要留出把手,传送带上的杯子还需随时间更新抓取点。
现有 VLG 方法多为端到端,直接把视觉和语言映射到抓取,难以同时应对四类挑战:
- 空间:定位目标并避障,处理杂乱与遮挡
- 认知:理解物体用途
- 时序:跟踪动态变化的状态
- 具身:适配不同夹爪结构
「具身」频道最新
- Neuralink 用 5 万小时脑活动训练 AI 模型,光标控制破 11.32 bps 纪录 — mark_k · 2026-10-04
- 训练 128k 参数神经细胞自动机,用双耳声音「看见」墙角后的目标 — yacineMTB · 2026-10-04
- CoreWeave Physical AI 负责人谈机器人 sim-to-real 差距根源 — thursdai_pod · 2026-10-04
- 告别 CAD:用 LLM 写 Python 参数化建模块速造机器人 — natesiggard · 2026-10-03
- Sharpa D01 人形机器人灵巧抓取软质圆柱超人类水平 — CyberRobooo · 2026-10-03
- 899 美元 Mac Mini M6 被当上网本,其实是 24 小时 agentic 计算机器 — hey_abusiddik · 2026-10-03