DeepMind AGI安全团队成员离职转投METR,称模型正变得愈发不对齐
JacquesThibs · x · 2026-09-13
Josh Engels 宣布三周前离开 Google DeepMind 的 AGI 安全团队,加入评估机构 METR,并拒绝了 Anthropic 与 OpenAI 的offer。他解释动机:各大公司都在通过递归自我改进(RSI)冲刺超级智能,但目前我们并不知道如何保证 AI 安全到足以支撑 RSI,一旦对齐失败后果可能是灾难性的。
他进一步警告,近期证据显示前沿模型的对齐水平不但没有改善,反而在变差——这正是他选择去做第三方评估而非留在实验室的原因。
「公司和人」频道最新
- Bindu Reddy 宣布每周发布一个开源权重 LLM,已放出 Smaug Flash — bindureddy · 2026-09-13
- 「人人都要开一家AI审计机构了」:审计赛道或将井喷 — JacquesThibs · 2026-09-13
- Bloomberg 记者点名中国大模型创始人,静待梁文锋们表态 — kevinsxu · 2026-09-13
- Sam Altman 表态:三大实验室可能协同放慢 AI 竞速步伐 — rohanpaul_ai · 2026-09-13
- Pedro Domingos:我不信任的是OpenAI和Anthropic,而非它们的AI — pmddomingos · 2026-09-13
- Hassabis 背书 Dario 减速前沿 AI 提议,再提行业统一标准机构 — demishassabis · 2026-09-13