Patch Policy:利用密集视觉特征提升机器人控制效率
NielsRogge · x · 2026-08-13
推文介绍了一个名为 Patch Policy 的机器人学习架构。当前的机器人策略要么将观测压缩为单一全局 token,要么依赖沉重的视觉语言模型(VLM),牺牲了细节和速度。\n\nPatch Policy 通过一个极简的架构扩展,允许 Transformer 策略直接处理密集的预训练 patch token。其核心是一个块因果注意力掩码,既保留了时间因果性,又能处理大量 patch token。\n\n实验表明,该方法比使用全局池化表示的策略相对提升了 40%,且在仅使用 OpenVLA-OFT 约 0.7% 参数的情况下超越了它。
「具身」频道最新
- 物理信息数字孪生:将活性粒子变为自主机器人 — bravo_abad · 2026-08-13
- Autonomous 桌面机器人 Lamp 亮相:基于开源系统与 Reachy 互动 — dee_hw · 2026-08-13
- 美初创公司发力本土人形机器人,硬刚中国制造成本优势 — pstAsiatech · 2026-08-13
- 脑洞演示:当《GTA》游戏里混入机器人 — tres_pares · 2026-08-13
- 亚马逊数据中心引入机器人,全自动更换损坏硬盘 — chris_j_paxton · 2026-08-13
- Runway 宣布 9 月旧金山峰会,齐聚机器人与物理 AI 大佬 — c_valenzuelab · 2026-08-13