专题 · FULL STORY
前Anthropic研究员辞职并警告AI失控风险
9月初,27岁前研究员Jacob Coxon公开宣布从Anthropic辞职,指控业界豪赌超级智能,并接受CBS与CNN采访警告AI失控与灭绝风险;Anthropic对齐负责人Evan Hubinger随后公开认同其十年内灭绝概率超10%的判断,事件仍在发酵。
2026-09-12 ~ 2026-09-14 · 3 集 · 12 条
第 1 集 · 前 Anthropic/OpenAI 研究员警告 AI 失控风险(2026-09-12,2 条)
已离职的 Jacob Coxon 近日接连接受 CBS News 与 CNN 采访,谈及 AI 失控风险。他认为 AI 本质是代码,可通过互联网将自己传输到其他机器上,届时「拔插头也没用」。他还预测在递归自我改进驱动下,一年内编程、数学等多个领域的研究或无需人类参与,可能引发智能爆炸,引发业界对 AI 安全的关注。
- 前 Anthropic/OpenAI 研究员:CIT一年内多个领域研究或无需人类 — rohanpaul_ai · 2026-09-12
- 前 Anthropic/OpenAI 研究员受访:AI 或已能自我复制到别处「拔插头没用」 — _arohan_ · 2026-09-14
第 2 集 · 前Anthropic研究员Coxon公开辞职,警告超级智能豪赌(2026-09-13,8 条)
9月9日,27岁、曾先后在OpenAI与Anthropic从事三年预训练研究的Jacob Coxon在X上发帖宣布从Anthropic辞职,公开指控OpenAI与Anthropic「直冲自我改进的超级智能,拿我们的生命赌博」,并称两家公司都没有负责任行事。辞职帖获得约1.7亿次浏览,随后他接受ABC与BBC采访进一步阐述担忧,事件在多家头部AI公司内部与舆论场持续发酵。
已确认
- Coxon曾先后任职于OpenAI与Anthropic,在Anthropic从事AI模型训练相关工作,9月9日发帖公开辞职并表达对AI风险的担忧。
- 接受ABC采访时,他将构建AI比作「召唤一个我们尚不完全理解的外星心智」,表示即使没有具体场景,这种想法本身就相当可怕。
- 他认为AI可能是人类创造过的最危险技术,是一种无法像核武器那样被控制的超级武器,当前的竞赛正把人类引向灭绝。
- 在BBC专访中,Coxon称按当前进度若不减速,「我们极有可能在不久的将来全部死亡」并非夸张;他表示许多亲手编写前沿模型的内部人士每天背负着「人类灭亡概率超过10%」的判断,并称内部人员「真心为人类未来恐惧」。
- 《纽约时报》记者Mike Isaac报道了AI公司内部正在滚雪球的超级智能风险讨论,称此事引发四大公司内部对末日风险的激辩。
- 据转述,Anthropic高层回应时提及十年内AI毁灭人类的概率超过10%;此前研究员Hubinger也表态认为AI十年内有10%的毁灭风险。
为什么重要
- Coxon是亲手训练模型的内部人员,其公开离职使「实验室内部是否真正重视安全」的争议被推向公众视野。
- 事件带动了关于自我改进超级智能竞赛与人类生存风险的讨论,多家头部AI公司内部亦就末日风险展开激辩。
- 前 Anthropic 研究员离职帖引爆 1.7 亿浏览,Hubinger 表态 AI 十年内 10% 毁灭风险 — adamamcbride · 2026-09-13
- Anthropic 研究员辞职指控「拿人命赌博」,高层回应称十年内灭人类概率超10% — kevinsurace · 2026-09-13
- Anthropic 模型训练员 Jacob Coxon 离职,称 AI 是无法控制的最大危险技术 — victor_explore · 2026-09-13
- 27 岁前 Anthropic 研究员辞职上 BBC:内部人员「真心为人类未来恐惧」 — rohanpaul_ai · 2026-09-14
- 前 OpenAI/Anthropic 研究员 BBC 专访:从业者普遍估灭亡概率超 10% — rohanpaul_ai · 2026-09-14
- Anthropic 研究员因 AI 风险公开离职,四大公司内部激辩末日风险 — RebeccaBellan · 2026-09-14
- 前 Anthropic 员工 Jacob Coxon 辞职,称造 AI 如「召唤外星物种」 — AlexTensor · 2026-09-14
- 前 OpenAI/Anthropic 研究员公开辞职:两巨头正豪赌超级智能 — vkrakovna · 2026-09-14
第 3 集 · Anthropic对齐负责人认同AI十年内灭绝人类概率超10%(2026-09-13,2 条)
前Anthropic员工Jacob Coxon称AI在未来十年杀死全人类的概率大于10%,Anthropic对齐科学负责人Evan Hubinger对此表示认同,引发圈内外的广泛抨击。与此同时,Andy Hall在Substack长文《The Makers of our Fate》中讨论当前AI风险争论,解释自己为何不认同这种"即将灭绝"的说法。
- Anthropic 研究员 Evan Hubinger:十年内 AI 致人类灭绝概率超 10% — soumitrashukla9 · 2026-09-13
- Anthropic对齐负责人认同AI十年内灭绝人类概率超10%,引发圈内外抨击 — firstadopter · 2026-09-14