RobustSGPO 优化 Agent harness:30 项保留任务完成率 60%→80%

dair_ai · x · 2026-09-10

dair-ai 推荐给做自动化 prompt/harness 进化的人:RobustSGPO 改进了基于执行反馈的语义梯度 prompt 优化。原方法的局部更新规则从不决定单次修改的幅度和操作类型,RobustSGPO 补上了这一点——指定请求的编辑、构建并校验补丁后再接受,并从当前最优解或保留快照继续搜索。

在 AgentX 头脑风暴工作流上测得:120 项任务、95 次运行、7350 次候选尝试,2000 万 token 预算下,30 项保留任务的完成率从 60.0% 升至 80.0%,测试质量从 3.77 升至 4.14。

另一发现:周期性按 1→2→3 放宽每步编辑权限的调度,比固定最大权限高出 0.28 分——优化器每步允许多大改动本身就是值得调度的对象。保留快照机制也有效。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →