前安全负责人逐条对比:METR为何比实验室自测更可信
joshua_saxe · x · 2026-09-14
Joshua Saxe 在与 halvarflake 的争论中列出了 AI 安全测试的现状清单:实验室组建资源不足的安全团队,发布前做无透明度、无同行评审的实验,结果写进 system card 和博客;再雇用估值取决于与实验室关系的营利公司做补充测试,偶尔(且频率指数级递减)发一篇安全论文。
相比之下,METR 是不接受实验室资金的非营利组织,发表质量更高。「批评 METR 的各种缺陷没问题,但『不该信任 METR、他们低诚信且不科学』的说法站不住脚。」
所属事件:METR 独立性风波:AI 审计生态遭遇旋转门质疑(31 条相关)→
「安全」频道最新
- 活动家扮毁灭博士现身西雅图议会,抗议全市监控摄像头扩张 — jonerp · 2026-09-14
- METR 遭攻击:泄露 API 密钥三周烧掉约 60 万美元 — AlexTensor · 2026-09-14
- Epoch 研究员梳理「给 AI 降速」工具箱:限 RSI、限算力、限内部 Agent 预算 — connoraxiotes · 2026-09-14
- 《反编译之书》上线:开源教程讲透二进制到伪C全过程 — blaizedsouza · 2026-09-14
- Hesamation 炮轰 OpenAI:先公开你已知的那 10 多起事件再说 — Hesamation · 2026-09-14
- Yudkowsky 表态:没有什么比两党合作监管 AI 更重要 — Polymarket · 2026-09-14