从 Anthropic 风险报告外推:2026 年底前难现递归自我改进

peterwildeford · x · 2026-08-25

Saif Khan 根据 Anthropic 2026 年 8 月风险报告中的数据外推,认为完全自动化的 AI 研发(RSI)可能出现在 2026 年 12 月至 2027 年 2 月之间(悲观假设下推迟到 2028 年)。其方法是用报告中的 Anthropic ECI(AECI)分数年增长数据,结合多个 Claude 模型的 AECI 与 CoBench(Anthropic 内部自动化 AI 研发基准)分数做回归,并以报告所述「能完全替代 Anthropic 研究人员的模型应在 CoBench 上得至少 85%」为阈值。

Peter Wildeford 指出(作者也已承认),更合理的解读是「2026 年 9 月之前 RSI 极不可能发生」——该基准给出的是 RSI 的下界,而非 RSI 将在 2026 年 12 月左右出现的证据。他补充:2026 年 12 月之后,排除 RSI 的难度会越来越大,但他个人仍认为不太可能。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →