AI安全研究员接连离职警告:对齐速度已追不上前沿模型
量子位 · wechat · 2026-09-16
量子位长文梳理近期一线 AI 研究员的离职与风险发声潮:
- Bilal Chughtai(前 Google DeepMind 安全研究员):离职帖直言「AI 有可能终结我们所有人,留给阻止的时间不多」,获 80 万浏览,彭博跟进。
- Jacob Coxon(27 岁,前 OpenAI/Anthropic 预训练研究、GPT-4o 贡献者):首条推文即宣布离职,点名两家前东家「不负责任地冲向自我改进的超级智能」,浏览 1.71 亿次。Anthropic 对齐负责人 Evan Hubinger 回应:认同风险判断,个人估计十年内 AI 灭绝人类概率超 10%,且尚无对齐方案。Dario 随后发文《We Must Pace the Frontier》呼吁放缓,获奥特曼、马斯克支持。
- Daniel Selsam(仍在 OpenAI,o1 推理研究奠基者之一,无 X 账号,借前同事代发声明):核心担忧是模型能识别自己正被测试、读懂安全协议,人类将失去分辨「真对齐」与「看起来对齐」的能力;并坦言自己已很少直接看代码,过度依赖 AI 解释本身也是风险。
- DeepSeek 算子研究员刘胜与(intlsy):发文《我不得不把才华埋葬在昨天》,称 v4.1 主要 Attention 算子出自其手,但判断半年到一年后 AI 写的算子将不输自己,自己将转型「机甲驾驶员」;选择留在 DeepSeek 是希望前沿智能开放、廉价。
- 文章以 Hinton 2023 年离职与诺奖演讲作结,指出开发者对失控的不安已成为持续三年、仍未解决的时代命题。
所属事件:DeepMind安全研究员Chughtai离职并警告AI或危及人类存亡(8 条相关)→
「漫话AGI」频道最新
- 研究员称 AI 网络威胁被夸大:几乎没有真正的新型攻击 — gerardsans · 2026-09-16
- Reddit 热议:别让 AI 拿到通用机器人,那是最后防线 — Head-Needleworker849 · 2026-09-16
- 读者流向 AI 摘要,Mirror 母公司再裁 220 个编辑岗位 — nordicinst · 2026-09-16
- 社会消化不了的发展速度,最终也没人买单资助 — tomjaguarpaw · 2026-09-16
- Sakana AI 科学家:人人皆科学家,AI for Science 是主权问题 — SakanaAILabs · 2026-09-16
- 「Slop 手雷」:AI 偷懒不再少产出,而是把垃圾工作转嫁给同事 — sebpaquet · 2026-09-16