Ben Todd 复盘 AGI 2030 预测:大体应验但节奏偏慢
ben_j_todd · x · 2026-09-22
Ben Todd 回顾 18 个月前的长文《Will we have AGI by 2030?》,认为预测大体成立、但进展略慢于预期。
应验部分:四大进步驱动力(预训练、RL、测试时算力、agent scaffolding)都持续有效。他给出的 2026 年底预测对照现实:
- FrontierMath:"50% 到饱和" → 已饱和
- METR 50% 时间视界:6 小时 → 16 小时+
- Humanity's Last Exam:"40% 到饱和" → 已 54%
- SWE-bench Verified 与 GPQA:饱和 → 饱和
- 前沿模型营收:预测年 4 倍 → 实际年 6 倍
他还自豪于把 agent 称为 scaling 的下一阶段、点出可验证性是进步的关键轴,且没有预测大规模失业。并称在数学领域可能已实现超越人类的问题解决能力。
自认失误:低估了算力转向 RL 会拖慢预训练趋势,可能过度强调测试时算力;现在更重视 2028 年后放缓、AGI 推迟到 2030-2035 的第三种情景;但 2029 年前实现 AGI 的概率反而上调了。
所属事件:Ben Todd 复盘 AGI 2030 预测:大体应验但节奏偏慢(2 条相关)→
「漫话AGI」频道最新
- Interconnects 播客:与 Epoch AI 辩论 RSI、美中差距与前沿训练配方 — natolambert · 2026-09-22
- 播客深谈前沿 AI 未来:机器人、中国模型差距与开源安全 — natolambert · 2026-09-22
- Gary Marcus:近期威胁不是灭绝,而是深度伪造虚假信息 — GaryMarcus · 2026-09-22
- AI 2027 复盘:现实进展约为该预测的 70%-90% 速度 — ben_j_todd · 2026-09-22
- AI 风险学者回应质疑:我的担忧恰恰源于无知而非预知 — danfaggella · 2026-09-22
- 谷歌安全高管:AI 攻防要靠自主防御,人类只需做监督者 — philvenables · 2026-09-22