递归自我改进比想象更近:Schmid 剖析 Agent 自改代码现状
_philschmid · x · 2026-08-21
前 Hugging Face 工程师 Philipp Schmid 发文讨论「递归自我改进」(RSI)离我们并不遥远:如今的 agent 已经能检查失败的运行、编辑自己的工具/skills/harness 代码并保留有效的改动,开始形成狭义的自改循环。
文章给出清晰定义:RSI 是系统做出持久性改变、既提升未来表现又提升产生后续改进的能力。他区分了三个层次:
- Iteration:只改输出,系统不变(改代码重跑测试);
- Self-improvement:系统持久改变(新增工具、记录 skill),后续任务跑在改过的系统上;
- Recursive self-improvement:验证器也随之提升,后续轮次面对更难但仍然诚实的测试。
他提到 Pi 处于领先、其他玩家跟进、DeepSeek 走到极端,并认为这些由 autoresearch 和递归自我改进驱动。结论是:虽然结果还很粗糙,但各个部件正在逐渐接上,狭义的智能爆炸回路轮廓已现。
「漫话AGI」频道最新
- 长时程 Agent 技术入门:METR 时长倍增与工程挑战 — agihouse_org · 2026-08-21
- Chamath 指出 AI 领导者在赢得公众信任上惨败 — Polymarket · 2026-08-21
- 中国将AI设为中小学必修课,美国教育政策对比鲜明 — aakashgupta · 2026-08-21
- 知情者确认神秘模型 Ox Alpha 能力惊人:多模态智能体竞赛提速 — omarsar0 · 2026-08-21
- Cathie Wood:初级岗位消失将催生创业爆发 — mitchdeg · 2026-08-21
- 研究者称AI或有一种可实证测量的现象体验,但与人类迥异 — ctjlewis · 2026-08-21