Anthropic 员工自曝:十年内 AI 灭绝人类概率超 10%
DKokotajlo · x · 2026-09-10
AI 就业研究者 Molly Kinder 描述了自己在送孩子上学后刷到一系列 AI 安全讨论时的心理转变:她多年来把「对齐」「x 风险」当背景噪音,但近几周因 Hugging Face 事件、METR 独立评测报告,以及实验室内部人士接连发出的警告而深受震动。
核心引文来自 Anthropic 员工 Evan Hubinger:他和同事们「真心相信 AI 有可能杀死全人类」,他个人估计未来十年内发生概率超过 10%;他认为 Anthropic 已尽力,但公司尚未有解决超级智能对齐的方案,且「并不明确走在正轨上」。
这条帖子折射出一线从业者从抽象担忧转向切身恐惧的舆论变化。
所属事件:Anthropic研究员自估十年内AI灭人概率超10%,对齐尚无方案(12 条相关)→
「漫话AGI」频道最新
- AI 访谈新玩法:不生育者主因自由受限,观望者嫌太贵 — soumitrashukla9 · 2026-09-10
- 剑桥教授 Krueger:AI 灭绝风险超 50%,圈内仍在系统性低估 — KatjaGrace · 2026-09-10
- MIT 施瓦茨计算学院启动试点:帮高校教师跨学科教 AI — nordicinst · 2026-09-10
- 开发者用数百个 AI Agent 并行攻关,瞄准 1 型糖尿病治愈 — Scobleizer · 2026-09-10
- 主动式 Agent 来了:Muse 记得女儿 8 岁生日,主动提议帮忙办派对 — altryne · 2026-09-10
- 图灵罕见预判:机器思考一旦启动,将很快超越人类智力 — acmoytoy · 2026-09-10