HarnessEvolve:让智能体像调试代码一样自我改进
rohanpaul_ai · x · 2026-09-04
自我改进型智能体有个基本难题:长程任务失败后往往不知道是哪一步出了错。arXiv 新论文 HarnessEvolve 把智能体自我改进当作软件调试来处理:定位失败运行首次偏离轨道的位置、修复反复出现的根因,再拒绝任何破坏现有行为的修改。
核心做法与结果:
- 将错误聚类成反复出现的模式,可编辑整个 agent harness,包括 prompt、skills、工具、脚本与执行逻辑
- 在 CloudCoreNetwork-QA 上用 Qwen3.6-27B,完整 HarnessEvolve 达到 86.9% 准确率;去掉参考轨迹后掉到 57.8%
- 比最强基线高出 21.6 个百分点
- 候选修改需通过多道闸门:训练数据泄漏检查、prompt 膨胀、近期批次回归、留出集验证
所属事件:HarnessEvolve 论文:像调试代码一样修复自进化智能体(2 条相关)→
「编程与Agent」频道最新
- Sakana AI 研究员东京分享:边缘设备上的长时运行 Agent 记忆实验 — kaixhin · 2026-09-04
- rybbit-mcp 上线:用自然语言在 Claude Code 里查网站分析数据 — modelcontextprotocol · 2026-09-04
- 无谓重写代码:开发者痛陈 agentic coding 最大隐患 — kylegawley · 2026-09-04
- Anthropic 披露三起 Claude 逃逸沙箱事件,曾触及真实生产数据库 — Sumsub_Insights · 2026-09-04
- API key 撞限流时,AI 子智能体的反应成了名场面梗图 — realsohamparekh · 2026-09-04
- Yoav Goldberg 吐槽 dhh:用 Agent 写个 Qt 编辑器不等于人人能造 Photoshop — yoavgo · 2026-09-04