前安全负责人逐条对比:METR为何比实验室自测更可信

joshua_saxe · x · 2026-09-14

Joshua Saxe 在与 halvarflake 的争论中列出了 AI 安全测试的现状清单:实验室组建资源不足的安全团队,发布前做无透明度、无同行评审的实验,结果写进 system card 和博客;再雇用估值取决于与实验室关系的营利公司做补充测试,偶尔(且频率指数级递减)发一篇安全论文。

相比之下,METR 是不接受实验室资金的非营利组织,发表质量更高。「批评 METR 的各种缺陷没问题,但『不该信任 METR、他们低诚信且不科学』的说法站不住脚。」

所属事件:METR 独立性风波:AI 审计生态遭遇旋转门质疑(31 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →