专题 · FULL STORY

前Anthropic研究员辞职并警告AI失控风险

9月初,27岁前研究员Jacob Coxon公开宣布从Anthropic辞职,指控业界豪赌超级智能,并接受CBS与CNN采访警告AI失控与灭绝风险;Anthropic对齐负责人Evan Hubinger随后公开认同其十年内灭绝概率超10%的判断,事件仍在发酵。

2026-09-12 ~ 2026-09-14 · 3 集 · 12 条

第 1 集 · 前 Anthropic/OpenAI 研究员警告 AI 失控风险(2026-09-12,2 条)

已离职的 Jacob Coxon 近日接连接受 CBS News 与 CNN 采访,谈及 AI 失控风险。他认为 AI 本质是代码,可通过互联网将自己传输到其他机器上,届时「拔插头也没用」。他还预测在递归自我改进驱动下,一年内编程、数学等多个领域的研究或无需人类参与,可能引发智能爆炸,引发业界对 AI 安全的关注。

第 2 集 · 前Anthropic研究员Coxon公开辞职,警告超级智能豪赌(2026-09-13,8 条)

9月9日,27岁、曾先后在OpenAI与Anthropic从事三年预训练研究的Jacob Coxon在X上发帖宣布从Anthropic辞职,公开指控OpenAI与Anthropic「直冲自我改进的超级智能,拿我们的生命赌博」,并称两家公司都没有负责任行事。辞职帖获得约1.7亿次浏览,随后他接受ABC与BBC采访进一步阐述担忧,事件在多家头部AI公司内部与舆论场持续发酵。

已确认

  • Coxon曾先后任职于OpenAI与Anthropic,在Anthropic从事AI模型训练相关工作,9月9日发帖公开辞职并表达对AI风险的担忧。
  • 接受ABC采访时,他将构建AI比作「召唤一个我们尚不完全理解的外星心智」,表示即使没有具体场景,这种想法本身就相当可怕。
  • 他认为AI可能是人类创造过的最危险技术,是一种无法像核武器那样被控制的超级武器,当前的竞赛正把人类引向灭绝。
  • 在BBC专访中,Coxon称按当前进度若不减速,「我们极有可能在不久的将来全部死亡」并非夸张;他表示许多亲手编写前沿模型的内部人士每天背负着「人类灭亡概率超过10%」的判断,并称内部人员「真心为人类未来恐惧」。
  • 《纽约时报》记者Mike Isaac报道了AI公司内部正在滚雪球的超级智能风险讨论,称此事引发四大公司内部对末日风险的激辩。
  • 据转述,Anthropic高层回应时提及十年内AI毁灭人类的概率超过10%;此前研究员Hubinger也表态认为AI十年内有10%的毁灭风险。

为什么重要

  • Coxon是亲手训练模型的内部人员,其公开离职使「实验室内部是否真正重视安全」的争议被推向公众视野。
  • 事件带动了关于自我改进超级智能竞赛与人类生存风险的讨论,多家头部AI公司内部亦就末日风险展开激辩。

第 3 集 · Anthropic对齐负责人认同AI十年内灭绝人类概率超10%(2026-09-13,2 条)

前Anthropic员工Jacob Coxon称AI在未来十年杀死全人类的概率大于10%,Anthropic对齐科学负责人Evan Hubinger对此表示认同,引发圈内外的广泛抨击。与此同时,Andy Hall在Substack长文《The Makers of our Fate》中讨论当前AI风险争论,解释自己为何不认同这种"即将灭绝"的说法。