前 Anthropic 研究员离职帖引爆 1.7 亿浏览,Hubinger 表态 AI 十年内 10% 毁灭风险
adamamcbride · x · 2026-09-13
一场关于 AI 实验室安全立场的风波正在发酵:
- 9 月 9 日,前 OpenAI/Anthropic 研究员 Jacob Coxon 发帖称辞职,指责两家实验室"直冲自我改进的超级智能,拿我们的生命赌博",帖子获约 1.7 亿次浏览。
- Anthropic 对齐科学负责人 Evan Hubinger 引用回应:"Jacob 说得对——我们真的认为 AI 可能杀死全人类,我个人认为十年内概率 >10%",并承认公司尚无针对超级智能的对齐方案。
- 帖主将事件串联成所谓"AI 心理战时间线",还提及 Bernie Sanders 等的介入,担忧政府与 AI 实验室绑定、垄断智能控制权。
事件核心是前沿实验室内部人士罕见公开承认末日级风险,同时被不同立场的人解读为炒作或警示。
所属事件:前研究员辞职指控 AI 实验室冒险,高层称毁灭风险超10%(2 条相关)→
「漫话AGI」频道最新
- 「犯罪的是人不是模型」:反对把 AI 拟人化的观点引热议 — StewartalsopIII · 2026-09-13
- 研究者逐条拆解五大 AI 末日场景:老安全原则即可化解 — vishalmisra · 2026-09-13
- 「每年 1000 名儿科癌症患者是真的」:加速派用病房反驳 AI 灭世论 — IgorCarron · 2026-09-13
- Dean Ball 预警:METR 将成抹黑目标,独立审计生态受威胁 — deanwball · 2026-09-13
- 研究者逐一拆解五大 AI 末日场景:常规安全实践即可阻断「灭绝」路径 — vishalmisra · 2026-09-13
- 学者调侃:校园或需设「AI 戒断互助会」帮学生控制用 AI — IanArawjo · 2026-09-13