Jeff Ladish 密集发声:质疑 Anthropic 透明度与 RSI 安全约束
AI 安全研究者 Jeff Ladish 于 09-07 在同一讨论线程中密集发声,核心质疑是:为什么近来 OpenAI 在透明度上反而超过了 Anthropic?他希望 Anthropic 就内部研究加速(RSP 类议题)与国际协调两个方向发布更详细的说明文章,并表示基于此前言论,他将对透明度提出极高标准,直言自己看到的情况。
已确认
- Ladish 对 Anthropic 在递归自我改进(RSI)方面的约束计划表示几乎毫无信心,也不相信其会真正停下来;他对比称 OpenAI 曾声称至少暂停过一次 RL 训练运行数周,而 Anthropic 是否做过类似动作不明。
- 他警告,对把「全自动化 AI 研发」当作默认路线应保持极度怀疑,认为这听起来像一场灾难,甚至可能是字面意义上的人类死亡。
- 他称不希望看到 Anthropic 失败并把巨大风险外部化给全世界,也乐于被证明是错的,担心 Anthropic 已(或正在)落入与 OpenAI 等其他实验室相同的风险引力阱。
- 他转引 Tim Hua 的分析并评论:OpenAI 据称因 Anthropic 在 Claude Code 上的强势表现,被迫押注 AI 编程性能、加速冲刺 RSI。
- 他表达对 AGI 竞赛的直接担忧:人类不想与远比自己强大的优化过程进行资源竞争,一纸协议保证不了份额;「不能阻碍创新」的逻辑对其他技术成立,但 AI 越过临界点后会灾难性地自我加速(其转述称,不放缓智能爆炸就可能导致死亡)。
- 讨论背景涉及 Anthropic 新文章《When AI builds itself》,其中称工程师季度代码量已提升 8 倍;以及 Anthropic 8 月风险报告(Zvi Mowshowitz 撰文解读,总体积极但含保留)。
为什么重要
- 这是前沿实验室安全研究者公开施压的一手声音,直接指向 Anthropic 的披露范围与 RSI 暂停机制的可信度。
- 涉及全自动 AI 研发、智能爆炸等极端风险叙事,与实验室实际研发节奏(如 Claude Code 竞争驱动的加速)之间的张力,是当前 AI 治理辩论的核心议题。
2026-09-07 ~ 2026-09-07 · 10 条相关
一手来源
- 安全研究者发问:OpenAI 近期是否比 Anthropic 更透明? — JeffLadish ·
- 安全研究员 Jeff Ladish:全自动 AI 研发堪称灾难,或致 literal 死亡 — JeffLadish ·
- Jeff Ladish 质疑 Anthropic 的 RSI 约束:OpenAI 停过 RL,Anthropic 呢? — JeffLadish ·
- Jeff Ladish:不放慢智能爆炸我们就会死,实验室停不下来 — JeffLadish · 2026-09-07
- 安全研究者称 OpenAI 因 Claude Code 竞争压力转向代码与 RSI 竞速 — JeffLadish · 2026-09-07
- 【源头】安全研究者发问:OpenAI 近期是否比 Anthropic 更透明? — JeffLadish · 2026-09-07
- Jeff Ladish 续问:盼 Anthropic 披露内部研究加速与国际协调细节 — JeffLadish · 2026-09-07
- Anthropic 发文谈递归自我改进:工程师季度代码量已提升 8 倍 — JeffLadish · 2026-09-07
- Anthropic 8月风险报告:披露新模型与自主智能体风险 — JeffLadish · 2026-09-07
- 【源头】Jeff Ladish 质疑 Anthropic 的 RSI 约束:OpenAI 停过 RL,Anthropic 呢? — JeffLadish · 2026-09-07
- Jeff Ladish 担忧 Anthropic 正滑向其他实验室同样的风险引力阱 — JeffLadish · 2026-09-07
- 【源头】安全研究员 Jeff Ladish:全自动 AI 研发堪称灾难,或致 literal 死亡 — JeffLadish · 2026-09-07
另有 1 条近重复转述:JeffLadish