研究追踪 1002 项 AI 安全评测:仅 1 项促成实际政策行动

StephenLCasper · x · 2026-10-12

Stephen Casper 与 Kunal Singh 在 MATS 展出的一项研究追踪了 1002 项已发表的 AI 评测发现,其中 185 项针对具名 AI 公司,但只有 1 项促成了有约束力的政策行动——即 Amazon 标记的「fix this code」窄越狱漏洞,最终促使美国政府将 Fable 下线三周。

核心结论:

完整工作即将公开发布。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →