安全研究员激辩:METR的模型安全测试够独立吗

joshua_saxe · x · 2026-09-14

AI 安全研究者 Joshua Saxe 回应 halvarflake 对 METR 的质疑。Saxe 过去四年深耕 LLM 发布前安全测试,认为 METR 相较现状已是迈向独立性的重要一步,批评可以有但部分指责缺乏同侪善意。他还指出 METR 比 AI 实验室的 system card 开放得多,且曾发表对自身论点不利的结果,赢得了信任。

所属事件:METR 独立性风波:AI 审计生态遭遇旋转门质疑(31 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →