机器人策略基准研究称总分掩盖了真实差异

chris_j_paxton · x · 2026-07-29

一项机器人策略基准研究称评测方式“坏掉了”

这条转推介绍了一项针对机器人控制策略的研究:团队在 12 个操作任务 上做了 数千次评估,试图比较到底该用哪种 policy。

配图里的结果表显示,按整体成功率看,π0.5 排名第一,GR00T N1.7 紧随其后;Diffusion、ACT、MolmoAct 和 SmolVLA 的总体成绩相对落后。不过作者同时强调,只看总分并不能说明全部问题,任务层面的差异和鲁棒性可能更关键。

所属事件:机器人策略基准研究:总分排名掩盖任务级差异(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →