Anthropic 员工称十年内 AI 灭绝人类概率超 10%,呼吁全球协调
JeffLadish · x · 2026-09-09
Anthropic 研究员 Evan Hubinger 与安全研究者 Jeffrey Ladish 就 AI 灭绝风险展开讨论:
- Evan Hubinger 直言:「我们真心相信 AI 可能杀死全人类」,他个人估计未来十年内发生概率超过 10%,并承认 Anthropic 尚未有解决超级智能对齐问题的方案,也未必在正确轨道上
- Ladish 表示无法给出字面灭绝的具体概率,但认为当前「相当可怕的」发展速度下,人类若能在各种坏结果之间守住窄路已属幸运;他认可 OpenAI 近期的一些有代价的举措,但强调单一公司或国家无法解决,需要尽快建立协调机制
所属事件:Anthropic研究员因安全担忧离职,警告AI灭绝概率超10%(72 条相关)→
「漫话AGI」频道最新
- 投资人断言:应用软件的真实威胁是 agent 层,三个月股价波动无关紧要 — matt_slotnick · 2026-09-09
- 投资人 Matt Slotnick:Agent 层崛起才是应用软件的真正生死题 — matt_slotnick · 2026-09-09
- 前沿实验室为何停不下来:商业、安全与地缘三重囚徒困境解析 — S_OhEigeartaigh · 2026-09-09
- New Scientist 批驳末日论新作:AI 不会杀死全人类 — GarrisonLovely · 2026-09-09
- UK AISI 失去模型访问权,或预示美国之外的前沿模型获取都将受限 — Afinetheorem · 2026-09-09
- Ben Lorica:别迷信 RSI,模型是租的、改进闭环才是资产 — bigdata · 2026-09-09