安全研究员激辩:METR的模型安全测试够独立吗
joshua_saxe · x · 2026-09-14
AI 安全研究者 Joshua Saxe 回应 halvarflake 对 METR 的质疑。Saxe 过去四年深耕 LLM 发布前安全测试,认为 METR 相较现状已是迈向独立性的重要一步,批评可以有但部分指责缺乏同侪善意。他还指出 METR 比 AI 实验室的 system card 开放得多,且曾发表对自身论点不利的结果,赢得了信任。
所属事件:METR 独立性风波:AI 审计生态遭遇旋转门质疑(31 条相关)→
「安全」频道最新
- 活动家扮毁灭博士现身西雅图议会,抗议全市监控摄像头扩张 — jonerp · 2026-09-14
- METR 遭攻击:泄露 API 密钥三周烧掉约 60 万美元 — AlexTensor · 2026-09-14
- Epoch 研究员梳理「给 AI 降速」工具箱:限 RSI、限算力、限内部 Agent 预算 — connoraxiotes · 2026-09-14
- 《反编译之书》上线:开源教程讲透二进制到伪C全过程 — blaizedsouza · 2026-09-14
- Hesamation 炮轰 OpenAI:先公开你已知的那 10 多起事件再说 — Hesamation · 2026-09-14
- Yudkowsky 表态:没有什么比两党合作监管 AI 更重要 — Polymarket · 2026-09-14