Anthropic对齐负责人:十年内AI灭绝人类概率超10%

9月9日,Anthropic对齐科学负责人Evan Hubinger在X上公开表态:构建AI的人确实真诚地相信AI有可能杀死全人类,这并非营销话术;他个人估计未来十年内这一风险发生的概率超过10%。他同时坦言Anthropic正在尽力降低该风险,但目前还没有解决超级智能对齐问题的方案,也不认为当前路径明确通往解决方案。这是来自一线前沿实验室对齐负责人的罕见量化风险表态,多位作者转发讨论。

已确认

为什么重要

2026-09-09 ~ 2026-09-09 · 13 条相关

一手来源

另有 11 条近重复转述:AICopyLab · EvanHub · ramagetime · ccerrato147 · JosephJacks_ · Polymarket · kevinnbass · AndyMasley · EvanHub · JeffLadish · sjgadler