HumanCLAW 实测:最强 VLM 完成具身交互任务的比例仅 16.8%

jiqizhixin · x · 2026-09-13

Meta、南洋理工、华盛顿大学、布朗大学与西北大学联合提出 HumanCLAW,研究 VLM 能否真正"通过身体行动"而不只是描述所见。

框架要点:

结果:9 个前沿 VLM 在同一协议下测试,最好的模型也只完成 16.8% 的完整交互——理解世界不等于能行动于世界。项目已完全开源。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →