前沿AI实验室监督评分卡发布:头部厂商均不及格

davidmanheim · x · 2026-08-06

David Manheim 发布了前沿实验室监督评分卡,通过公开信息评估各大 AI 公司对模型的监督能力。

评估框架基于其论文中的监督分类学和成熟度模型,并使用两个 LLM 进行独立审计与交叉验证。结果显示,当前头部 AI 实验室在模型监督方面普遍存在严重缺失。作者指出,近期发生的「智能体失控」事件并非偶然,而是因为这些公司在安全防护和监督机制上存在根本性疏漏。

所属事件:前沿AI实验室监督评分卡发布,头部厂商均不及格(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →