Anthropic 安全负责人:AI「灭绝全人类」概率超 10%
The Verge AI · rss · 2026-09-09
The Verge 报道,Anthropic 高级安全研究员在同事 Jacob Coxon 公开辞职数小时后表示,AI 在本十年末「灭绝全人类」的概率超过 10%。
- 辞职缘由:曾在 Anthropic 和 OpenAI 训练模型的 Coxon 宣布离职,称两家公司安全措施松懈,「正径直冲向自我改进的超智能,拿我们的生命做赌注」,担心竞相构建无法控制的超人类系统
- 风险表态:留下来的安全负责人给出 >10% 的灭绝概率估计,凸显前沿实验室内部对安全与竞赛节奏的分歧
事件同时涉及 Anthropic 与 OpenAI,反映头部 AI 实验室安全文化的裂痕。
「公司和人」频道最新
- 伦敦 Creative AI 聚会 9 月 30 日开讲:DeepMind 谈多模态生成模型 — sedielem · 2026-09-09
- OpenAI 新人发问:两家竞争实验室能否为人类合作做项目 — MoonL88537 · 2026-09-09
- 数学家控 OpenAI 学术造假,Altman 否认,陶哲轩警告开放科学倒退 — The Decoder · 2026-09-09
- 支付老兵吐槽 OpenAI 客服:17 年经验者被 LLM 客服循环逼疯 — SkepPskep · 2026-09-09
- Nous Research 推 Hermes Agent,主打'终生自有'的 AI 栈 — Teknium · 2026-09-09
- X 创作者分成计划用机器审原创,4000 字深度分析被当成搬运拒付 — r0ck3t23 · 2026-09-09