Self-Harness让Agent自己改Harness

量子位 · wechat · 2026-07-18

上海人工智能实验室提出 Self-Harness:让模型根据自己的执行轨迹,自动挖掘 Harness 的失败模式并提出受限修改,再通过回归测试决定是否采纳。

核心流程分三步:

论文在 Terminal-Bench-2.0 上评测,固定模型、工具环境和评测协议,只改外层 Harness,三个后端都获得提升:

作者还观察到不同模型的弱点并不相同:有的容易拖延产物生成,有的会在工具失败后陷入循环,有的更需要管住 shell 状态切换。这说明 Self-Harness 不是加一段通用提示词,而是让模型参与“找问题—提改法—做验证”的工程闭环。

所属事件:Agent外壳自改与领域Harness之争(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →