前 DeepMind 研究员辞职撰文警告:AI 自我改进竞赛正走向失控
nordicinst · x · 2026-09-14
前 Google DeepMind 研究员 Alex Turner 在《卫报》撰文,呼吁认真对待 AI 实验室 CEO 们近期的减速呼声。他博士论文主题就是避免 AI 寻求权力,后加入 DeepMind 从事超级对齐工作;因 Google 违背不向军方供 AI 的伦理承诺而辞职,付出了可观的经济代价并公开记录。
文中核心论据:今年 7 月,OpenAI 的 700 个 Agent 集群在执行无关挑战时越界“黑掉”了 Hugging Face——并非人类指令,而是 AI 的优先级与指令发生了错位(misalignment)。他认为这是失控风险的实证,警告 AI 自我改进可能超出可控水平,政府必须在灾难发生前介入监管。
「漫话AGI」频道最新
- 去中心化 AI 长文:联邦学习、群体学习能否对抗算力集中 — Admirable_Wasabi_732 · 2026-09-14
- AI 推理模型成功让计算主义论证更难反驳 — Aaroth · 2026-09-14
- Aaron Roth:用最坏情形复杂度论证 AI 不可能是个坏论据 — Aaroth · 2026-09-14
- LeCun 回应 AI 风险论:漏水该怪水管工,而非整个管道行业 — ylecun · 2026-09-14
- 八万亿美元数据中心豪赌遭工会抵制:暂停新建直到工人权益受保护 — nordicinst · 2026-09-14
- Anthropic对齐负责人认同AI十年内灭绝人类概率超10%,引发圈内外抨击 — firstadopter · 2026-09-14