Anthropic 研究员辞职抗议,引发 AI 实验室「偏好级联」风暴
Don't Worry About the Vase (Zvi) · rss · 2026-09-11
Zvi 发长文梳理了席卷 OpenAI、Anthropic 和 Google 的 AI 安全「偏好级联」事件。
导火索:在 Anthropic 与 OpenAI 做了三年预训练研究的 Jacob Coxon 于 9 月 8 日辞职抗议,称两家公司都在「不负责任地直冲自我改进的超级智能,拿全人类的生命赌博」。他警告这些系统很快将能入侵一切、一夜之间颠覆任何领域。他在 WSJ 采访中称,按最激进的情景,明年年底局势就可能失控。
级联扩散:Anthropic 对齐科学负责人 Evan Hubinger 公开声援,称自己真诚相信 AI 可能在十年内有超过 10% 的概率杀死所有人类,且 Anthropic 尚无解决超级智能对齐的方案。前 Google DeepMind 研究员 Alex Turner 也表示许多研究者相信自己正在建造可能杀死所有人的东西。
舆论反应:WSJ、CNN、FT、BBC、Axios 等主流媒体大量报道,Jimmy Kimmel 也在脱口秀中讲了四分钟。Zvi 分析了为何此时爆发:过去两个月各实验室内部对进展速度的观察令员工恐慌加剧,而辞职这种「代价高昂的信号」触发了公开表态的连锁反应。
核心矛盾:文章指出 Anthropic 和 OpenAI 有商业动机去淡化而非夸大生存风险,这让这些警告更值得认真对待;留在实验室的研究者(如 Hubinger)与辞职者(如 Coxon)的选择逻辑也被对比讨论。
「漫话AGI」频道最新
- 菲尔兹奖联名信遭反弹,Twitter 上连 AI 反对者都觉得恶心 — iruletheworldmo · 2026-09-12
- 吐槽「暂停 AI」派:不懂博弈论、激励与经济 — nptacek · 2026-09-12
- repligate 谈为何仍尊重 Eliezer:对齐领域稀缺的「扶手椅哲学」先行者 — repligate · 2026-09-12
- tszzl 长文:美国自由言论文化是 AI 发展的隐形基石 — tszzl · 2026-09-12
- 对齐讨论的共同盲区:两派都把AI当成工具 — RileyRalmuto · 2026-09-12
- 博主指控 AI 风险叙事的最大金主系“欺骗性招募工具” — kevinnbass · 2026-09-12