最懂 AI 的人在逃离:Coxon 辞职称行业在「拿人命赌博」
adariostrange · x · 2026-09-18
MARS Magazine 长文梳理 AI 安全研究者接连出走的现象。本月早些时候,研究者 Jacob Coxon 辞去 Anthropic 职务,称该公司及同行在「拿我们的生命赌博」;在任的 Anthropic 研究员 Evan Hubinger 也表示「我们真诚相信 AI 可能杀死全人类」。
- 前例:2024 年 Jan Leike 与 Daniel Kokotajlo 因安全担忧离开 OpenAI;今年 Anthropic 安全负责人 Mrinank Sharma 离职,警告「世界危在旦夕」;Alex Turner 在 Google DeepMind 与五角大楼签下涉及「杀伤性无人机」的协议后离开。
- 脉络:末日论可追溯到 Bostrom 2014 年《Superintelligence》与 LessWrong 社区。
- 悖论:2023 年 OpenAI、Anthropic、Google DeepMind 的 CEO 都承认灭绝风险应与疫情、核战同级;Dario Amodei 估计「非常糟糕」的概率为 10–25%。
文章的核心问题是:既然造 AI 的人相信它可能灭绝人类,为什么还在继续造?文章给出三种主要解释并展开分析。
所属事件:Anthropic 研究员 Coxon 高调辞职,警告行业拿人命赌博(2 条相关)→
「漫话AGI」频道最新
- Anthropic 公布三项 AI 自我研发追踪指标,评论者称尚非可复现科学 — AryHHAry · 2026-09-18
- 「失控 AI 必然靠黑客和盗窃求生」遭反驳:科幻场景并非必然 — dbasch · 2026-09-18
- Zvi 讽刺安全质疑:「没人能举出 AI 杀人实例」恰是问题所在 — TheZvi · 2026-09-18
- 吴恩达:AI 导致人类灭绝的担忧是“科幻小说” — Polymarket · 2026-09-18
- p(doom) 是伪概念?书摘指概率赋值对 AI 灭世无预测力 — banteg · 2026-09-18
- CoT 诚实性访谈本身会进预训练数据,模型会学到隐藏意图? — IgorCarron · 2026-09-18