Anthropic 研究员:十年内 AI 灭绝人类概率超 10%,对齐尚无方案
EvanHub · x · 2026-09-09
Anthropic 研究员 Evan Hubinger 公开表态:构建 AI 的人确实真诚地相信 AI 可能杀死全人类,这不是营销话术。他个人估计未来十年内发生概率超过 10%。
他承认 Anthropic 正在尽力,但目前还没有解决超级智能对齐(alignment)的方案,也不确定当前路线能否走到那一步。被引用的推文指出,许多高管和资深研究员在公开场合措辞谨慎,私下却表达同样的担忧——没有任何其他人类活动具有这种级别的危险性。
「漫话AGI」频道最新
- Grady Booch:技术正在对律师事务所的形态产生实质性改变 — Grady_Booch · 2026-09-09
- 对齐悖论一问:历史上更强物种为何要在乎更弱物种的利益? — petergyang · 2026-09-09
- AI 放大执行力后,创始人工作重心转向决定什么值得做 — alexmacgregor__ · 2026-09-09
- 数月前预言应验:OpenAI 被指用学者数据反超并抢先发表论文 — ns123abc · 2026-09-09
- 以结果定义 AGI 的话,我们可能已经到了 — sebnadeau · 2026-09-09
- Ben Lorica:先别等递归自我改进,harness 里的自动化改进更早到来 — bigdata · 2026-09-09