AMP 提出把机器人操控化为像素分类,绕开动作空间爆炸
jiqizhixin · x · 2026-09-18
LLM 验证了交叉熵预测在 1D 序列上的可扩展性,但机器人动作本质是高维的:每个时间步 6–7 个自由度,即使粗粒度离散化(每维 10 档)也会产生约 100 万种组合动作,更细的离散化或更长时域会让空间彻底爆炸,因此 LLM 的交叉熵范式无法直接套用到机器人学习。
Action Map Policy(AMP)提出新的机器人操控学习范式:把高精度 3D 闭环操控重新表述为图像空间中的像素分类问题。模型不再在组合爆炸的动作 token 空间里预测,而是在一张 action map(把 3D 运动编码为空间位置的 2D 表示)上分类“在哪行动”,从而把交叉熵预测范式从语言迁移到机器人领域,同时避开维度灾难。
「具身」频道最新
- 复古视频回顾:小团队用模块化架构在野外测试机器人 — abursuc · 2026-09-18
- 机器人初创招聘心得:办活动让人才自我筛选 — DominiqueCAPaul · 2026-09-18
- 开源物理仿真器 MuJoCo 获开发者青睐,用于模块化机器人配置验证 — Obijuan_cube · 2026-09-18
- 斯坦福 FAMOS:稀疏单目点云前馈推断 3D 铰接物体关节参数 — Stanford-University · 2026-09-18
- Waymo 宣布 2028 年落地新加坡,进军东南亚首个自动驾驶出租车市场 — emmanuelvivier · 2026-09-18
- Agility Robotics 发布 Digit 5 人形机器人,专为与人类近距离协作设计 — emmanuelvivier · 2026-09-18