SeededGrasp 将语言理解与抓取生成分离,真实成功率达 78%
Yang Xu · hf · 2026-07-23
SeededGrasp 是一个面向复杂场景的语言引导抓取框架,把语义理解和几何执行拆开处理。
- 先由 VLM 根据语言指令预测一个 seed point。
- 再由轻量级抓取生成模型基于该点输出最终抓取方案,避免昂贵的端到端训练。
- 作者发布了首个 多 embodiment 桌面抓取数据集,包含超过 250 万 个杂乱场景抓取样本。
- 实验结果显示,该方法在仿真中成功率达 72%,真实机器人实验达 78%,优于现有基线。
「具身」频道最新
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11