Patch Policy 用 0.7% 参数量在单张 5090 上胜过 OpenVLA-OFT
ChongZzZhang · x · 2026-07-23
Patch Policy 认为,机器人策略不一定要靠 7B 参数堆出来,关键是利用稠密视觉特征。
- 方案是 预训练 ViT + 小型 transformer,据称在参数量只有 OpenVLA-OFT 的 0.7% 时,效果还更好。
- 训练硬件只用到 一张 RTX 5090。
- 演示里它能以约 2 mm 的容差完成插线,并且在执行过程中被中途打断后,重新回到任务仍能继续成功。
所属事件:Patch Policy 借稠密视觉特征实现机器人操控新突破(4 条相关)→
「具身」频道最新
- NVIDIA 说物理 AI 需要 EB 级仿真数据 — jonstephens85 · 2026-07-23
- 马斯克称 Optimus 要做首个日常可用的人形机器人 — XFreeze · 2026-07-23
- NVIDIA 开源机器人仿真器把训练从 5 小时压到 2 分钟内 — imjustnewatai · 2026-07-23
- 又一条 Vicarious 与 da Vinci 的机器人商业化对照 — AIandDesign · 2026-07-23
- 特斯拉称 Optimus 产线已开始安装,量产“很快”启动 — Polymarket · 2026-07-23
- Patch Policy 用 0.7% 参数量,操控成绩反超 7B VLA 18% — ylecun · 2026-07-23