METR 独立性风波:AI 审计生态遭遇旋转门质疑
9 月 12 日至 14 日,围绕 AI 安全评估机构(尤其 METR)的独立性爆发了一场多方参与的大讨论。导火索是 Anthropic 提议由 METR 作为自愿性质的第三方监督其 AI 系统的方方面面,以及 METR 与 Redwood 获得 OpenAI-Hugging Face 事件日志分析权的安排。讨论的核心结论是:审计生态在人事关系、资金来源、意识形态同质性与遴选透明度上均存在结构性独立性问题;辩护方认为这是行业现实的结构性结果,而更激烈的批评者(如 Heidy Khlaaf、Halvar Flake)则直接指控这是「监管俘获」。
已确认
- Deborah Raji(rajiinio)明确指出负责 HF/OpenAI 事件调查的一名 METR 调查员与 OpenAI 董事会成员存在婚姻关系,并提及多数访问合同条款对评估的约束(细节在帖中未完全展开);她同时肯定 Anthropic 开放外部审计的姿态,但强调成熟审计生态必须有审计师行为标准。
- Anthropic 的「Pacing the Frontier」倡议被 ruima(经 kristoph 转发)质疑未承诺放慢训练或内部能力研究,具体承诺仅是引入「第三方」监督。
- 有用户(经 NielsRogge 转发)指出时间线的戏剧性:一位 Anthropic 员工离职加入 METR,次日 METR 即被 Anthropic 提名为第三方评估方。
- Beff Jezos 质疑 Redwood Research 与 METR 等机构中充斥曾在大厂任职、持有相关股票期权的研究者,预言大厂与「审计类 NGO」之间将形成旋转门,演变为保护内部人共同利益的监管;他还反讽各实验室的安全评测是「朋友互相打分」。
- evijit 指出名义独立的第三方预发布测试中,拿到先看资格的机构多由前实验室员工和实验室创始人的朋友运营,可从近期 system cards 中查证;他并追问 OpenAI-HF 事件日志为何只给了 METR 和 Redwood,而非同样有意获取的 CAISI、CISA 等政府机构,遴选标准何在。
- Melanie Mitchell 向 Nathan Lambert 提出普遍性担忧:若评估者心怀被 OpenAI 雇佣或收购其初创公司的期待,独立性难以维系。
- 有业内人士(经 emax 转发)指出所谓独立评估机构多出自同一批 EA 背景圈子,拿同一批 Open Philanthropy 资金,机构创始人曾在 OpenAI 任职。
- @NathanB60857242 提出更具体的指控:METR 虽不直接拿实验室的钱、形式上独立,但与 Anthropic 在社交与文化上深度交织,且其捐助方的资金池很大部分来自 Anthropic 股份;他主张将 METR 视为「带星号的独立」并不为过。
- Heidy Khlaaf(经 sarahbmyers 转述)指控 Anthropic 推动「监管俘获」:METR 在意识形态与资金上均与厂商绑定,且审计方法不科学——依赖链式思维(CoT)等手段并选择性采信证据,以强化 AGI 叙事。
- 安全圈知名人物 Halvar Flake(经 basedjensen、AccBalanced 转发)附议 Khlaaf 的质疑,称 METR 既不独立也不科学;他并讽刺 METR 与前沿实验室的独立性只是法律层面的,如同苏联加盟共和国在联合国拥有独立席位,并非真正独立的第三方。
- Gary Marcus 表态「METR 很棒,但 METR 不是答案」;另有评论者更尖锐地称 METR 并不独立,是硅谷最激进的 AI 安全主义/有效利他主义团体之一(经 AlexTensor 转发)。
- Kyrannio 炮轰圈内对独立评估者的「孩童式理想主义」,称这些评估者将决定模型训练状况、对齐程度与发布与否,而市场与现实并不按善意运作。almmaasoglu 也对「自愿性第三方监督一切」的安排表示难以置信。
各方辩护
- MaskedTorah 回应 evijit 称这是行业现实的结构性结果:长期研究安全风险的人彼此熟识、其中不少进入工业界,任何有真实专长的人都难免与实验室有关系,独立事故调查也无需实验室内部权限。
- BronsonSchoen 反驳称 METR 拿到的模型访问权极其有限,连 Hugging Face 级别的访问都难争取,说明实验室并未袒护评测方;但他也提示前沿实验室或可借利益冲突(COI)筛选「合规」评测方。
- Joshua Saxe 从业内视角回应 Halvar Flake:他过去四年深耕 LLM 发布前安全测试,认为 METR 相较现状已是迈向独立性的重要一步,批评可以有,但部分指责缺乏同侪善意。
为什么重要
- 外部审计被视为 AI 公司安全治理与前沿降速政策的关键机制,而此次争议显示审计生态在人事关系(婚姻、前雇主)、资金来源(捐助方资金池与 Anthropic 股份的关联)、意识形态同质性与遴选透明度上均存在结构性独立性问题。evijit 强调,当这些评测被绑定到国际 AI 治理政策时,影响公众的事物应能被公众检验,评测准入应更开放。随着 Halvar Flake、Heidy Khlaaf 等安全圈人物将指控升级为「监管俘获」,以及 Gary Marcus 等更广泛圈内人士加入质疑,事件进一步推动了建立审计师行为标准与制度化独立性保障的讨论。
2026-09-12 ~ 2026-09-14 · 31 条相关
- 第 1 集:OpenAI 员工接连发声:AI 可能毁灭人类,应放慢脚步(2026-09-10,4 条)
- 第 2 集:OpenAI问国会:协调放缓AI开发是否违反反垄断法(2026-09-11,4 条)
- 第 3 集:Dario 长文呼吁降速,Altman 与马斯克罕见同声附和(2026-09-11,56 条)
- 第 4 集:Amodei、Altman、Musk 齐呼吁给 AI 降速,引发动机大争论(2026-09-11,62 条)
- 第 5 集:Dario Amodei 发文呼吁前沿 AI 统一降速(2026-09-12,196 条)
- 第 6 集:METR 独立性风波:AI 审计生态遭遇旋转门质疑(2026-09-12,31 条)
- 第 7 集:Dario长文呼吁放缓前沿AI,遭业内多方质疑(2026-09-13,18 条)
- 第 8 集:Dario 呼吁放缓 AI 并引入独立评估,Altman 表态支持(2026-09-13,4 条)
- 第 9 集:开放权重监管之争:分级管控、禁令传闻与开源生态存亡(2026-09-13,18 条)
- 第 10 集:OpenAI研究员谈实验室限速协议:驯服超智能靠科学(2026-09-13,3 条)
- 第 11 集:「减速中国也会慢」言论遭群嘲 中美AI竞速成梗(2026-09-13,4 条)
- 第 12 集:开源阵营回击:前沿放缓声明是过度反应(2026-09-13,4 条)
- 第 13 集:实验室员工缘何集体恐慌:真威胁还是监管俘获(2026-09-13,5 条)
- 第 14 集:曝 Anthropic 与 OpenAI 放缓研究或为 IPO 铺路(2026-09-13,2 条)
- 第 15 集:Chollet 质疑前沿实验室安全提案:警惕监管俘获(2026-09-13,3 条)
- 第 16 集:Hassabis 背书 Dario 减速提议,标准组织已有 AI 委员会(2026-09-13,2 条)
- 第 17 集:网友批 AI 实验室安全表态虚伪:真担忧就该自行放慢(2026-09-13,3 条)
- 第 18 集:白宫AI主管Sacks回应降速论:双寡头减速无需监管批准(2026-09-13,6 条)
- 第 19 集:Anthropic CEO 称 AI 进展超预期,呼吁行业放慢脚步(2026-09-13,2 条)
一手来源
- METR 调查员与 OpenAI 董事会成员联姻,AI 审计独立性遭质疑 — rajiinio ·
- Anthropic 倡议引争议:安全评估机构被指与大厂存在「旋转门」 — beffjezos ·
- 争议:Anthropic 力推 METR 被指监管俘获,CoT 审计方法遭质疑 — sarahbmyers ·
- Deborah Raji 质疑 AI 审计独立性:METR 调查者与 OpenAI 董事联姻 — rajiinio · 2026-09-12
- METR 当评估者没毛病,但监督者不应同温层 — Dr_Atoosa · 2026-09-13
- 第三方预发布评测被批「近亲审查」:拿首发资格的多是前实验室员工 — evijit · 2026-09-13
- evijit 补充:影响公众的 AI 评测应能被公众检验,而非圈子内部 — evijit · 2026-09-13
- 有人质疑 Dario 慢化倡议:METR 监督独立成色几何 — kristoph · 2026-09-13
- 业内人士质疑 AI 评估机构独立性:同一批 EA 资金与 OpenAI 人脉 — emax · 2026-09-13
- 评测机构独立性争议:前沿实验室或借 COI 挑选合规评测方 — BronsonSchoen · 2026-09-13
- OAI-HF 事故日志仅给 METR 和 Redwood?研究员质疑遴选标准 — evijit · 2026-09-13
- 安全研究者辩护:独立 AI 事故调查无需实验室内部权限 — MaskedTorah · 2026-09-13
- 安全研究者质疑 OpenAI 事件日志为何仅限 METR 与 Redwood 获取 — evijit · 2026-09-13
- Melanie Mitchell 质疑:AI 独立评估者如何避开旋转门? — MelMitchell1 · 2026-09-13
- Nathan Lambert 谈评估者独立性:过度承诺独立是起点 — natolambert · 2026-09-13
- 【源头】Anthropic 倡议引争议:安全评估机构被指与大厂存在「旋转门」 — beffjezos · 2026-09-13
- Anthropic员工跳槽METR,次日METR成其第三方评估方 — NielsRogge · 2026-09-13
- Kyrannio 炮轰「独立评估机构」:别对 AI 审计抱孩童式理想主义 — Kyrannio · 2026-09-13
- Kyrannio 炮轰第三方模型评估员:失控的外部评估将反噬模型本身 — Kyrannio · 2026-09-13
- Anthropic 提议由 METR 任自愿第三方监督,引社区质疑 — almmaasoglu · 2026-09-13
- e/acc 创始人暗讽:各实验室安全评测为何都是「朋友互相打分」 — beffjezos · 2026-09-13
- Halvar 观点:METR「独立」于前沿实验室只是名义上的 — AccBalanced · 2026-09-13
- Halvar 严批 METR 既不独立也不科学,指其沦为 Anthropic 监管俘获工具 — basedjensen · 2026-09-13
- ThePrimeagen 断言「METR 并不独立」,前 OpenAI 安全负责人转发 — Miles_Brundage · 2026-09-14
- 【源头】争议:Anthropic 力推 METR 被指监管俘获,CoT 审计方法遭质疑 — sarahbmyers · 2026-09-14
- Gary Marcus 转发质疑:METR 很强,但不该成为 AI 监管答案 — AlexTensor · 2026-09-14
- AI Now 论文警示:削弱 AI 风险阈值的安全修正主义 — sarahbmyers · 2026-09-14
- METR 独立性引争议:资金是否依赖 Anthropic 股份成焦点 — dylanbowmanSF · 2026-09-14
- AI 安全审计讨论:METR 的独立性应被打上星号吗 — NathanB60857242 · 2026-09-14
- 前 CAISI 成员论战:安全机构难以摆脱实验室社交圈束缚 — joshua_saxe · 2026-09-14
- halvarflake回应:找不受实验室影响的安全研究员有多难 — halvarflake · 2026-09-14
- 安全研究员激辩:METR的模型安全测试够独立吗 — joshua_saxe · 2026-09-14
- 前安全负责人逐条对比:METR为何比实验室自测更可信 — joshua_saxe · 2026-09-14
另有 1 条近重复转述:rajiinio