SimWorld 推出 RT-SAFE 基准:前沿 VLM 实时安全成功率从 19.8% 跌至 0.7%

Lianhuiq · x · 2026-10-06

SimWorld 团队发布 RT-SAFE,一个基于 SimWorld 的新基准,用于在实时安全约束下评测具身智能体,并实测了多个前沿 VLM:

核心发现:智能体可以在完成任务的同时安全性急剧恶化;而且「更多推理」未必是答案——当现实世界持续运动时,更长的推理延迟本身就带来物理风险。

结论:对具身 AI 而言,延迟既是智能的一部分,也是安全的一部分。

所属事件:RT-SAFE 基准:前沿 VLM 任务成功率高但安全通过率仅 0.7%(3 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →