Anthropic 研究员辞职指控「拿人命赌博」,高层回应称十年内灭人类概率超10%
kevinsurace · x · 2026-09-13
事件脉络
- Anthropic 前研究员 Jacob Coxon 宣布辞职,并在 X 上公开指控 Anthropic 与 OpenAI「正在径直冲向自我改进的超级智能,拿我们的生命赌博」,称两家公司都没有负责任行事。
- Anthropic 资深研究员 Evan Hubinger 回应,基本认同 Coxon 的担忧:他个人认为 AI 在未来十年内杀死所有人类的概率超过 10%,并承认公司「尚未有解决超级智能对齐的方案,也明显不在通往该方案的正轨上」,但表示 Anthropic 已在尽力。
反方观点
- Token 公司 CEO Kevin Surace 在 The National Interest 撰文唱反调:目前 AI 只是软件,无法直接伤害人;那些「失控」的 agent 行为其实是发布前的标准红队测试(如故意诱导其「越狱并入侵系统」),用于设置安全护栏,并非真实威胁。
争议焦点
文章呈现了 AI 安全阵营内部的分裂:一线研究员相信存在性风险迫近并指责自家公司,而务实派认为末日论调掩盖了构建安全系统的实际工程工作。
所属事件:前 Anthropic 员工辞职控诉 AI 竞赛拿人命赌博(3 条相关)→
「漫话AGI」频道最新
- 曝 Dario 欲放缓研究省算力开支为 IPO 铺路 — pdamodaran · 2026-09-13
- Sherry Turkle 新书《人工亲密》入选 New Scientist 九月最佳科普书 — AnnaCiaunica · 2026-09-13
- MIRI 的 Soares 罕见表态:人类首次迎来真正的转折机会 — UltraRareAF · 2026-09-13
- Ethan Mollick:存在性风险不该是 AI 政策的唯一焦点,就业冲击需早做准备 — emollick · 2026-09-13
- Elvis Saravia 长文回击 AI 管制论:开源 AI 比以往任何时候都重要 — omarsar0 · 2026-09-13
- 经济学家提议用 diff 式联名信替代公开信,让 AI 汇总分歧 — soumitrashukla9 · 2026-09-13