Anthropic 三研究员公开谈灭绝风险,安全团队内部集体认同
Dapper-Tale-4021 · reddit · 2026-09-12
本周 Anthropic 前预训练研究员 Jacob Coxon 专门辞职以公开表态,称 OpenAI 和 Anthropic 都在「拿我们的生命赌博」,竞逐自我改进的超级智能而不负责任。现任对齐科学负责人 Evan Hubinger 回应确认:「Jacob 说得对,我们确实真诚地相信 AI 可能在十年内杀死全人类」,他把这一概率放在 10% 以上,并承认 Anthropic 尚无对齐超级智能的方案、也不确定能否得到一个;可扩展监督负责人 Samuel Marks 表态类似。安全实验室的安全团队公开认同因安全而离职者的警告。
作者认为「营销炒作」和「真心恐慌」两种主流解读都不准确,并指出落地现实的割裂:他接触的企业部署会议里没人讨论灭绝风险,关心的是凌晨三点无人值守时 CRM agent 会不会闯祸、出错谁签字负责。两场对话几乎无关却出现在同一新闻周期里,让中层企业做风险评估时信号完全混乱——如果造它的人都无法就生存威胁达成一致,企业该以什么为依据?
所属事件:头部实验室研究员密集警告AI灭绝风险,马斯克斥为心理战(17 条相关)→
「漫话AGI」频道最新
- 菲尔兹奖联名信遭反弹,Twitter 上连 AI 反对者都觉得恶心 — iruletheworldmo · 2026-09-12
- 吐槽「暂停 AI」派:不懂博弈论、激励与经济 — nptacek · 2026-09-12
- repligate 谈为何仍尊重 Eliezer:对齐领域稀缺的「扶手椅哲学」先行者 — repligate · 2026-09-12
- tszzl 长文:美国自由言论文化是 AI 发展的隐形基石 — tszzl · 2026-09-12
- 对齐讨论的共同盲区:两派都把AI当成工具 — RileyRalmuto · 2026-09-12
- 博主指控 AI 风险叙事的最大金主系“欺骗性招募工具” — kevinnbass · 2026-09-12