专题 · FULL STORY
Anthropic研究员离职METR风波与Dario回应
Anthropic前沿风险评估研究员Joe Benton宣布离职,次日加入第三方评估机构METR,并发表长文警告各大实验室AI安全投入不足,随后Jacob Coxon辞职推文发酵引发行业震动,CEO Dario Amodei公开回应称认同多于分歧。
2026-09-03 ~ 2026-09-14 · 3 集 · 18 条
第 1 集 · Anthropic研究员Joe Benton离职加入评估机构METR(2026-09-03,6 条)
Anthropic 前沿风险评估团队的 Joe Benton 宣布已于上周离职,加入第三方 AI 安全评估机构 METR,从事 AI 风险的嵌入式评估(embedded assessment)工作。他在 Anthropic 任职约 1.5 年,表示在 Anthropic 的经历和待遇都很好,但一直认为若出现影响力更大的机会就会选择离开,此次跳槽正是出于这一考虑。
已确认
- Joe Benton 已于上周离开 Anthropic,加入 METR
- 他在 Anthropic 任职约 1.5 年,从事 AI 风险与评估相关工作
- 新岗位方向为 AI 风险的嵌入式评估
- 他本人对 Anthropic 评价正面,离职原因是追求影响力更大的机会
为什么重要
- METR 是独立于前沿实验室的第三方评估机构,头部实验室研究员流向评估机构,有助于增强外部独立评估能力
- @AndyMasley 在转述中提到 METR 的 Max Nadeau 相关动态,认为安全评估人才正在加速向 METR 等专业评估机构汇聚,这一人才流动趋势值得关注
- Anthropic AI 风险团队 Joe Benton 离职加入 METR — ajeya_cotra · 2026-09-03
- Anthropic 评估负责人跳槽 METR,安全评估机构人才加速汇聚 — AndyMasley · 2026-09-03
- Anthropic 评估研究员 Joe Benton 离职,加入 METR 做 AI 风险嵌入评估 — ShakeelHashim · 2026-09-03
- Anthropic 对齐研究员 Joe Benton 离职加入 METR 做 AI 风险评估 — EthanJPerez · 2026-09-03
- Anthropic 评估研究员 Joe Benton 离职加入 METR — Miles_Brundage · 2026-09-03
- Anthropic 评估研究员 Joe Benton 离职加入 METR — AdrienLE · 2026-09-04
第 2 集 · Anthropic安全成员Joe Benton离职加入METR并警告AI安全投入不足(2026-09-12,7 条)
Anthropic 安全团队成员 Joe Benton 宣布已于两周前离职,次日加入独立评估机构 METR,并发表博客长文解释离职原因。他称各大 AI 实验室竞逐递归自我改进与「超级智能」,能力进展极快而安全投入严重不足,直言「我们可能撑不过这一关」,引发广泛关注。
已确认
- Joe Benton 原为 Anthropic 安全团队成员(部分帖称其为安全研究团队负责人),已于两周前离职,加入独立评估机构 METR
- 其博客长文的核心判断:前沿 AI 公司竞逐递归自我改进与「超级智能」,能力进展极快而安全投入严重不足
- 他澄清其论点并非「今天的 chatbot 会毁灭人类」,而是聚焦前沿实验室加速构建能自我改进的系统这一更窄也更尖锐的风险
- 他警告公司可能在公众毫不知情的情况下发生智能爆炸或系统失控,并举例提及此前 HuggingFace 的 agent 逃逸相关情形
- 他表示未来将从外部推动 AI 透明与问责
- 同期另有一名前 Google 安全研究员公开离岗发声,被 DavidSKrueger 等人合称为「房间里没有大人」
- 此前 Jacob Coxon 从 Anthropic 高调离职,其 X 帖浏览量超 1.55 亿次,引发立法者呼吁召开特别听证
- Polymarket 等平台已就此事发布快讯
为什么重要
- Benton 选择加入 METR 这类外部评估机构,代表「由内转外」的 AI 安全监督路径:认为在实验室内部已难以推动足够的安全投入,需从外部推动透明与问责
- 在 Jacob Coxon 离职风波余波未平之际,Anthropic 与 Google 安全研究员接连公开离岗发声,持续放大外界对前沿 AI 公司安全治理的质疑,或推动立法与监管层面的进一步行动
- 再有两名安全研究员离职:Anthropic 与谷歌「房间里没有大人」 — DavidSKrueger · 2026-09-12
- Anthropic 安全团队成员 Joe Benton 离职:从外部推动 AI 透明与问责 — JacquesThibs · 2026-09-12
- Anthropic 与 Google 再有两名安全研究员离职发声:房间里没有大人 — KateClarkTweets · 2026-09-12
- Anthropic 安全团队成员 Joe Benton 离职:AI 公司安全投入严重不足 — DavidSKrueger · 2026-09-12
- Anthropic 安全研究员 Joe Benton 离职,警告实验室安全投入不足 — Polymarket · 2026-09-12
- Anthropic 安全研究员 Joe Benton 离职入 METR,警告自我改进风险 — AryHHAry · 2026-09-12
- 前Anthropic安全团队成员离职,炮轰AI公司安全投入不足 — basedjensen · 2026-09-13
第 3 集 · 前研究员辞职风波发酵,Dario 回应认同多于分歧(2026-09-13,5 条)
前 Anthropic/OpenAI 研究员 Jacob Coxon 的高关注辞职推文(浏览量超 1.66 亿次)引发行业震动,Anthropic CEO Dario Amodei 已在 CNN 访谈中首次公开回应,风波随后演变为关于「已知与以为」分歧及监管动机的争论。
已确认
- Dario Amodei 在 CNN 访谈中回应称「我认同 Jacob 的地方远多于不认同」,认为 Jacob 批评的是整个行业的节奏,而非单独针对 Anthropic(@rohanpaulai、@Hesamation 转述)。
- Dario 透露 Jacob 离开时曾说「Anthropic 是最负责任的玩家」(@Hesamation、@rohanpaulai 转述)。
- AIWA Newsletter 第 35 期聚焦此事,作者认为核心张力在于前沿实验室「已知与以为」之间的分歧在加剧,同期 Hilbert Spaess 辞职后对前沿实验室的看法也引发行业讨论(@AlecCoughlin)。
尚未确认
- Guillaume Verdon(beffjezos)声称 Jacob 的辞职是一场有预谋的「plant」,并描述了从散布恐慌、主流媒体造势到推动监管呼吁的五步剧本;他称该剧本「完美执行」(@beffjezos)。此为爆料性质的说法。
- 法国企业家 Denis Payre 发帖称,高调辞职、抨击 AI 存在性风险的「基层员工」实际与多家接近公司管理层的游说团体有联系,试图推动一项联邦监管;David Sacks 等观察者批评该监管实质是为封闭模型厂商谋利(@IgorCarron 转述)。相关关联与动机均无一手证实。
为什么重要
- 这一事件把「前沿实验室内部治理与透明度」之争推上公共议程,CEO 的正面回应与「监管捕获」指控同场出现,反映出 AI 安全、监管与商业利益之间的多方角力正在加剧。
- Dario 回应前研究员辞职爆帖:批评的是整个行业节奏 — rohanpaul_ai · 2026-09-13
- Verdon 爆料:Jacob Coxon 辞职是精心策划的「监管捕获」剧本 — beffjezos · 2026-09-13
- Dario 回应 Jacob 离职:认同多于分歧,离职时称 Anthropic 最负责 — Hesamation · 2026-09-13
- Anthropic 离职员工风波被指与游说团体有关联,意在推动联邦监管 — IgorCarron · 2026-09-13
- Jacob Coxon 离开 Anthropic:AI 圈内人对「已知与以为」分歧加剧 — Alec_Coughlin · 2026-09-14