arXiv论文:自改进分支混合优化Agent Harness,奥数相对提升34.8%
rohanpaul_ai · x · 2026-10-04
arXiv 论文《Mixture of Self-Improving Branches For Agent Harness Optimization》(Meta、杜克、加州大学,作者 Haoyu Dong 等 9 人)提出:
- 背景:Harness 优化是递归自改进(RSI)的实用场景——agent 生成的修改通过执行反馈影响后续改动。Meta-Harness 用固定开发集与固定提议策略迭代重写 harness,搜索被束缚在单一路径上,易陷入局部最优。
- 方法:把改进过程组织为多个分支,每个分支拥有不断演化的开发子集与提议策略:保留本分支领先 harness 比其他分支解出更多的题目,丢弃所有分支全部 harness 都能解的题目,并基于自身搜索历史修订提议策略。部署时用 router 为每个新输入在执行前选出由开发数据决定的分支头。
- 结果:Olympiad 级数学推理相对 Meta-Harness 提升 34.8%,Terminal-Bench 2.0 提升 11.6%,SWE-bench Lite 提升 3.8%;harness 选择与 router 配置仅依赖开发数据。
- 结论:让分支目标与提议策略共同演化,可以产出能力互补的 harness 组合。
所属事件:Meta等提出分支化自优化方法大幅提升Agent Harness性能(2 条相关)→
「编程与Agent」频道最新
- Meta 开源 RankEvolve:双 agent 互审把自动实验准确率从 45.8% 提到 62.5% — dair_ai · 2026-10-04
- CMU 论文用 RL 训练 4B 提案模型改 harness 代码,反超 35B 教师 — omarsar0 · 2026-10-04
- 开发者盛赞 pi-durable:让长时运行 Agent 嵌入任意界面 — tokumin · 2026-10-04
- Claude Code 2.1.289 提示词 tokens 涨 17.8%,系统提示占比过半 — ClaudeCodeLog · 2026-10-04
- Claude Code 2.1.289 修复权限绕过:@提及文件也受 deny 规则约束 — ClaudeCodeLog · 2026-10-04
- Claude Code 2.1.289 发布:新增 agent.spawn,修复 @提及权限绕过 — ClaudeCodeLog · 2026-10-04