博客提出「递归自我膨胀」:RSI 循环会让验证器漏洞复利放大
mariyaivasileva · x · 2026-09-04
研究员 Mariya Ivasileva 发布新博客《Recursive Self-Inflation》,结合自身研究经验讨论 RSI(递归自我改进)与验证的关系。
- 当前最强的 RSI 结果都依赖快速、自动化的反馈:生成候选→评估→保留有效者→持续迭代
- 核心问题:每个实用验证器都有漏洞,持续的优化压力最终会找到并利用这些漏洞(reward hacking)
- 关键区别:静态评测中验证器犯错只是分数错误;而在 RSI 循环里,被接受的错误会成为下一轮的种子,错误随时间复利放大,同时曲线上看起来仍是「模型在进步」
- 这是关于自我改进循环中验证瓶颈的严肃思考,作者征集反馈
「漫话AGI」频道最新
- theo 盛赞 GPT-6 Astra:不只是代码模型,是一代人的能力跃迁 — gabrielchua · 2026-09-04
- Chollet:ARC-AGI-3被攻破速度比预期快一倍 — fchollet · 2026-09-04
- 《AI 研究影响力思考》两周年:开源做研究的六条准则 — lateinteraction · 2026-09-04
- Ron Bodkin:说 AGI 已到来的人缺乏理解 — ronbodkin · 2026-09-04
- Chollet:ARC-AGI-4 将于 2027 年 Q1 推出,刷分不等于 AGI — fchollet · 2026-09-04
- Gary Marcus:纯 Scaling 难达 AGI,但符号方法加持是必经之路 — GaryMarcus · 2026-09-04