RoboHarm 基准开源:任意 LLM/VLA 跑任意机械臂与人形机器人评测

chooi_jeq · x · 2026-09-19

作者发布 RoboHarm 基准及 300 条轨迹数据,并开源配套评测框架 inspect-robots(GitHub 上已有 544 星)。框架思路类似 Inspect AI,但面向物理 AI:定义一次机器人基准后,可将任意策略(LLM agent 或 VLA)运行在任意本体上——真实机械臂、人形机器人或模拟器——并输出可审计日志(评分、LLM 对话记录、完整配置),内置 Rerun 可视化。项目处于早期开发阶段,API 可能变动,官方建议锁定版本使用。

所属事件:RoboHarm 基准显示前沿机器人模型几乎不拒危险指令(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →