Grounded Action Models:基于 3D 定位的机器人基础模型新范式
DJiafei · x · 2026-09-26
HuggingPapers 介绍了 Grounded Action Models,一种新的机器人基础模型范式。
其核心思路是以 3D 定位(3D grounding)为基础,将语言、点、框等多种输入统一为共享的对象中心表示,再与机器人状态历史混合,用于预测动作块(action chunks)。这种设计让模型在统一的表征空间中连接语言指令与具体操作目标,是具身智能方向值得关注的新架构思路。
「具身」频道最新
- 行业老炮畅聊 Steam Frame、Snap SPECS 与 Meta VR 眼镜 — Scobleizer · 2026-09-26
- Jev-Omni 跑在 MacBook 上,本地柠檬质检每颗查 3 次 — airesearch12 · 2026-09-26
- 业界热议:ChatGPT语音模式证明前沿模型可做机器人实时控制 — notmisha · 2026-09-26
- 实测三家智能家居 AI 摄像头,Google Home 相机功能被认为最实用 — tomwarren · 2026-09-26
- Meta AI 玩偶 Muse 限成人使用,却长着 Labubu 式萌脸 — Wired AI · 2026-09-26
- 桌面机器人创企 eyecandy:SLAM 跑在 10 美元芯片上,先做娱乐场景落地 — k7agar · 2026-09-26