42组实验揭示:Agent自进化大部分轮次无效
teortaxesTex · x · 2026-08-16
论文《Rethinking Self-Evolving Agent Skills》通过42组进化实验发现,Agent自进化并非每轮都变强。在生成的388个候选Skill中,只有55个真正提升了验证集效果,许多轮次出现停滞或退化并被回滚。
关键结论包括:
- 最终入选的11个进化Skill全部使用了失败轨迹作为反馈,仅依赖成功轨迹的方案无一胜出。
- 失败反馈能明确指出修补方向,而成功反馈更适合保留现有能力。
- 自进化更像带验证和回滚的搜索过程,重点在于证明经验值得保留,而非单纯增加迭代轮次。
「编程与Agent」频道最新
- 开发者正为 DeepSeek Harness 打造美化与交互插件 — op7418 · 2026-08-16
- 用 soul.md 文件给 Agent 赋予真实个性和记忆 — amu4biz · 2026-08-16
- WebOSINT:自动化被动域名情报收集脚本 — tom_doerr · 2026-08-16
- Agent 开 PR 前先给自己打分:五阶段架构与三大踩坑 — LeftMethod1154 · 2026-08-16
- Qwen3.8 本地运行 1.7 小时生成 AI 日报 — Teknium · 2026-08-16
- 18模型自主编程大比拼:最强闭合人类记录82% — AI寒武纪 · 2026-08-16