Anthropic 对齐负责人:十年内 AI 灭绝人类概率超 10%
No-Meringue5867 · reddit · 2026-09-09
Anthropic 对齐科学负责人 Evan Hubinger 公开表态:团队真诚地相信 AI 有可能杀死全人类,他个人认为未来十年内这一风险超过 10%。他同时坦言,目前还没有解决超级智能对齐问题的方案,也不认为当前路径明确在通往解决方案的轨道上。这是前沿实验室安全负责人罕见的直白风险表态。
所属事件:Anthropic对齐负责人:十年内AI灭绝人类概率超10%(7 条相关)→
「漫话AGI」频道最新
- 「前沿模型为何没加速经济增长」引热议:答案是全球推理算力不够 — zephyr_z9 · 2026-09-09
- 研究者:数学界缺元科学传统,对 AI slop 判断多基于弱证据 — RexDouglass · 2026-09-09
- 研究者吐槽:AGI 炒作者连安全部署 AI 都做不到 — iamKierraD · 2026-09-09
- OpenAI 攻克千禧年大奖难题,为何软件仍bug不断 — ziv_ravid · 2026-09-09
- 半年逆转:AI 解 Navier-Stokes 从「民科」到认真讨论 — EigenGender · 2026-09-09
- Anthropic 研究员回应质疑:哪怕 10% 灭绝风险也要做好 AI — _aidan_clark_ · 2026-09-09