DeepMind 研究员:无节奏控制的 AI 进展已不安全
DeepMind 可解释性与对齐研究员 Neel Nanda 密集表态:当前 AI 进展在没有任何限速/节奏控制的情况下已明显不安全,但他对找到合理的「节奏协议」持乐观态度。他肯定前沿实验室引入嵌入评估者(embedded evaluators)是极好的第一步,但警告若无有约束力、可执行的协议,仅派驻评估员仍只是空口承诺,呼吁抓住公众关注 AI 存在性风险的共识窗口达成协议。
2026-09-13 ~ 2026-09-13 · 4 条相关
- Neel Nanda:派驻评估员只是第一步,需有约束力的协议 — NeelNanda5 · 2026-09-13
- Neel Nanda:当前 AI 进度不限速已不安全,应抓住共识窗口达成协议 — NeelNanda5 · 2026-09-13
- Neel Nanda:嵌入评估者是好的第一步,但缺约束协议仍是空话 — NeelNanda5 · 2026-09-13
- DeepMind 研究员 Neel Nanda:无节制的 AI 进展已明显不安全 — NeelNanda5 · 2026-09-13