智能体递归自我改进实验
markjeffrey · x · 2026-07-15
【引用内容】Weco 团队报告了其“自动研究自动研究代理”的首次递归自我改进(RSI)实验:让 agent 连续工作 8 天,自动研究并改写另一个 agent 的 harness(可理解为围绕模型的运行/执行层)。
他们声称,这套自动优化后的 harness 在留出集基准上,已经超过了团队手工调优两年的版本。帖文的核心判断是:AI 进展可能开始进入一个“通过自我改进加速”的阶段。
所属事件:AIDE² 八天自改进超越两年手调(12 条相关)→
「编程与Agent」频道最新
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11