Anthropic 研究员:十年内 AI 灭绝人类风险超 10%,对齐尚无解法
SatelliteNetSec · x · 2026-09-10
Evan Hubinger 回应关于数据中心建设的争议时表态:Anthropic 确实真心相信 AI 有可能灭绝人类,他个人认为未来十年内该风险超过 10%。他称 Anthropic 正在尽力,但目前尚未有解决超级智能对齐问题的方案,也谈不上走在正确的轨道上。
这条表态被两派引用:有人借此讽刺「最好的情形就是全民失业、财富集中到寡头手中,最坏情形是杀死全人类」;也有人(如 Hugging Face 的 Clement Delangue)主张既然风险如此之高,就需要百倍的研究投入,而封闭式研究无法应对全人类级别的风险。
所属事件:Anthropic研究员高调辞职警告AI赌命,引爆阴谋论与安全共识之争(238 条相关)→
「漫话AGI」频道最新
- 研究员批AI安全界混淆风险叙事:错误恐惧正在毁掉公众想象力 — Dr_Atoosa · 2026-09-11
- 安全从业者反思:廉价化的「AI 灭绝风险」话语如何毁掉公众想象力 — Dr_Atoosa · 2026-09-11
- 技术假说:ASI 会因数学激励而永久保护人类多样性 — No_Cause_2731 · 2026-09-11
- 博客提出:Scaling Laws 的根源在数据结构而非模型架构 — gleech · 2026-09-11
- AI 末日论甚嚣尘上,Reddit 求乐观共存的反方论证 — joshlove182 · 2026-09-11
- BlackHC:当前模型 x-risk 低,但不改变路径几年内风险会大增 — BlackHC · 2026-09-11