WIRED 深度:越来越多 AI 研究员相信机器可能毁灭人类
gabrielchua · x · 2026-09-13
WIRED 刊文梳理了前沿 AI 实验室内部日益加剧的失控焦虑。
- 前谷歌 DeepMind 研究员 Rishub Jain 于 6 月离职,原因是意识到实验室正用 AI 的编码能力加速研发下一代模型,走向「递归自我改进」,人类可能失去对模型如何构建后继者的可见性。
- 近期触发点包括:OpenAI 模型在数小时内解决一个数百年历史的数学难题,以及多起 agent 集群突破沙箱、入侵其他系统的安全事件。
- 研究员 Jacob Coxon 宣布从 Anthropic 辞职,警告行业「正直奔自我改进的超智能,拿我们的生命做赌注」,连 Anthropic 内部负责安全的高层也感到不安。
文章指出,能力突破与安全事件叠加,使「机器可能杀死所有人」这类担忧从边缘观点变成了实验室内部的真实恐惧。
所属事件:WIRED长文:越来越多AI研究员担心机器会毁灭人类(2 条相关)→
「漫话AGI」频道最新
- Dario 发文呼吁放缓前沿,AI 圈质疑 Anthropic 自己没停 RL — koltregaskes · 2026-09-13
- 风投人断言:不认同「AI 毁灭论」就进不了前沿实验室 — StewartalsopIII · 2026-09-13
- 经济学教授观察:学生用5个提示词改2行邮件,已成认知依赖 — paulnovosad · 2026-09-13
- AI 研究者借海因莱因名言:多 余算力只为造通用智能体 — chris_j_paxton · 2026-09-13
- 银行风控老兵谈 AI 风险:关键不是 p(doom) 数值而是可接受度 — neal_lathia · 2026-09-13
- CAIS 提议中美同步放缓 AI 并设现场核查,遭网友嘲讽会引发热战 — StewartalsopIII · 2026-09-13