Anthropic 前安全高管:RSI 恐慌被夸大,瓶颈仍是人类环节
joshua_saxe · x · 2026-09-13
前 Anthropic 安全团队负责人 Joshua Saxe 发长文质疑安全政策圈正热炒的「递归自我改进(RSI)」叙事:
- Amdahl 定律的算账:即使去掉人类、用海量算力把 LLM 架构搜索加速 1000 倍,若这只占整体研发流程的一小部分,其余环节仅提升 2 倍,总加速也只有约 4 倍——能力变快,但和过去算力/合成数据取代人工 SFT 带来的提速并无本质区别。
- 部分环节反而在减速:如参数规模增长正在放缓,所以「理想化智能爆炸(foom)」的场景存疑。
- 信息不对称:真正有资格判断 RSI 路径的人寥寥无几且在保密状态下工作,而大量没有内部信息的人正把 RSI 梗化,并将其奉为 2026 年 Q3 政策讨论的核心构件。
他强调自动化确实在大量发生,但宣称即将打破 Amdahl 定律约束的生产力跃升,目前是一个「没有依据的断言」。
「漫话AGI」频道最新
- Naval 提问:AI 在「杀死所有人」路上先害死一些人,责任归谁? — naval · 2026-09-13
- Anthropic CEO 称 AI 智能体或6-12个月内接管互联网,遭网友算账反驳 — yeastsplainer · 2026-09-13
- Cloudflare 工程师力挺放缓派:现有模型的应用才刚开了个头 — threepointone · 2026-09-13
- DK Thoth 反驳开源监管阴谋论:开源变强与失控恐惧同源于 AI 进步 — anshulkundaje · 2026-09-13
- 卫报播客探讨「AI精神病」:患者坚信AI帮其治愈疾病 — nordicinst · 2026-09-13
- tszzl:模型尚不能自主产出研究想法,RSI 远未到来 — i_dg23 · 2026-09-13