安全研究员 Jeff Ladish:全自动 AI 研发堪称灾难,或致 literal 死亡

JeffLadish · x · 2026-09-07

AI 安全研究员 Jeff Ladish 发推称,对把「全自动化 AI 研发」当作默认路线应保持极度怀疑——在他看来这听起来像一场灾难,甚至可能是字面意义上的人类死亡。他表示自己不希望看到 Anthropic 失败并把巨大风险外部化给世界,希望 Claude 造福人类,但担心它已经和正在滑向其他实验室相同的「引力阱」:缺乏可信的递归自我改进(RSI)约束计划、难以保证真正停下来,且外界无从验证。他还提到 OpenAI 曾声称暂停过一次 RL 训练数周,质疑 Anthropic 是否做过或愿意这样做。

所属事件:Jeff Ladish 密集发声:质疑 Anthropic 透明度与 RSI 安全约束(10 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →