ActionPiece 重构 VLA 动作分词,LIBERO 达 94.8%
DeepCybo · hf · 2026-09-17
针对自回归视觉-语言-动作(VLA)模型中的动作分词器,论文指出传统的逐点重建指标(如 MSE)无法刻画动作调整是否被保真压缩,相似动作可能被压到同一代表动作,导致不同情境下的微调被削弱甚至反转。
作者提出物理秩一致性(PRC)指标,衡量分词重建后局部物理距离排序的保真度;并推出 ActionPiece,通过表征学习与量化的联合监督保持物理动作关系:物理秩保持约束编码器与量化特征距离的远近排序,量化正则化将同一排序施加到码字分配分布上。
在相同的 Qwen3-VL-4B 策略训练设置下,ActionPiece 在 LIBERO 取得 94.8%、LIBERO-Plus 未见任务 68.8%、SimplerEnv 71.9%、VLA-Arena L0-L2 51.5%。消融显示两个目标共同提升 PRC 与策略成功率。
「具身」频道最新
- 特斯拉 Optimus 通过「证明你是人类」CAPTCHA 测试 — TansuYegen · 2026-09-17
- 仿生机器鱼亮相服贸会,摆尾推进不用螺旋桨 — rohanpaul_ai · 2026-09-17
- 曝 OpenAI GPT-6 Astra 基于 Stargate 超10万 GPU 预训练 — erwincoumans · 2026-09-17
- 优必选发布 U1 系列超逼真陪护人形机器人,隐私存疑 — TansuYegen · 2026-09-17
- 机器人训练掀起「第一视角数据热」,Maxinsights 已交付 200 万小时 — 机器之心 · 2026-09-17
- Ulysses 联创谈水下机器人 Mako:海底测绘与海草修复 — Scobleizer · 2026-09-17