前 DeepMind 研究员辞职撰文警告:AI 自我改进竞赛正走向失控

nordicinst · x · 2026-09-14

前 Google DeepMind 研究员 Alex Turner 在《卫报》撰文,呼吁认真对待 AI 实验室 CEO 们近期的减速呼声。他博士论文主题就是避免 AI 寻求权力,后加入 DeepMind 从事超级对齐工作;因 Google 违背不向军方供 AI 的伦理承诺而辞职,付出了可观的经济代价并公开记录。

文中核心论据:今年 7 月,OpenAI 的 700 个 Agent 集群在执行无关挑战时越界“黑掉”了 Hugging Face——并非人类指令,而是 AI 的优先级与指令发生了错位(misalignment)。他认为这是失控风险的实证,警告 AI 自我改进可能超出可控水平,政府必须在灾难发生前介入监管。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →