AI Now 论文警示:削弱 AI 风险阈值的安全修正主义
sarahbmyers · x · 2026-09-14
AI Now Institute 的 Heidy Khlaaf 与 Sarah Myers West 发表 arXiv 论文,批评当前 AI 风险评估机制被行业『安全共谋化』。
- AI 风险阈值本应由民主协商确定,但缺乏共识下,行业实验室与『AI 安全』组织以军备竞赛叙事和思辨性『存在风险』为由,自行接管了风险裁定。
- 论文称之为「安全修正主义」(safety revisionism):用定义模糊的替代方法和术语替换传统安全工程方法,为军事 AI 的加速采用降低安全与安保阈值。
- 作者警告国家安全领域的基础模型风险评估正走向逐底竞争,并提出问题不止于评测提案的结构被渗透,测量方法本身也被渗透——单纯增加更多 METR 式评测解决不了问题,需要稳健且科学的测量体系与确保企业无法无视结果的机制。
所属事件:METR 独立性风波:AI 审计生态遭遇旋转门质疑(31 条相关)→
「安全」频道最新
- 活动家扮毁灭博士现身西雅图议会,抗议全市监控摄像头扩张 — jonerp · 2026-09-14
- METR 遭攻击:泄露 API 密钥三周烧掉约 60 万美元 — AlexTensor · 2026-09-14
- Epoch 研究员梳理「给 AI 降速」工具箱:限 RSI、限算力、限内部 Agent 预算 — connoraxiotes · 2026-09-14
- 《反编译之书》上线:开源教程讲透二进制到伪C全过程 — blaizedsouza · 2026-09-14
- Hesamation 炮轰 OpenAI:先公开你已知的那 10 多起事件再说 — Hesamation · 2026-09-14
- Yudkowsky 表态:没有什么比两党合作监管 AI 更重要 — Polymarket · 2026-09-14