机器人策略基准研究称总分掩盖了真实差异
chris_j_paxton · x · 2026-07-29
一项机器人策略基准研究称评测方式“坏掉了”
这条转推介绍了一项针对机器人控制策略的研究:团队在 12 个操作任务 上做了 数千次评估,试图比较到底该用哪种 policy。
配图里的结果表显示,按整体成功率看,π0.5 排名第一,GR00T N1.7 紧随其后;Diffusion、ACT、MolmoAct 和 SmolVLA 的总体成绩相对落后。不过作者同时强调,只看总分并不能说明全部问题,任务层面的差异和鲁棒性可能更关键。
所属事件:机器人策略基准研究:总分排名掩盖任务级差异(2 条相关)→
「具身」频道最新
- 特斯拉车主称 FSD 每天约 1 美元,保险还能省 66 美元 — DMaguireARK · 2026-07-29
- 马斯克前合作伙伴:人形机器人将先于人类部署月球 — PeterDiamandis · 2026-07-29
- 300 美元 Meta 眼镜演示照片精确定位空间 — bilawalsidhu · 2026-07-29
- Aladdin 推出可预订的自主 moped 个人助理 — this_is_surabhi · 2026-07-29
- MIT 的 VLASH 让机器人通过预判未来状态加速 — songhan_mit · 2026-07-29
- CHORUS 预告单一 VLA 让多机器人分散协作 — chris_j_paxton · 2026-07-29