SkillHone 通过保留决策历史,把 GAIA 分数提升 15.8
jiqizhixin · x · 2026-08-04
腾讯/微信提出了 SkillHone,这是一个让 agent 持续进化技能的训练框架。
- 这个系统不会丢掉过去的尝试,而是保留每一次决策、修订和结果的 完整历史。
- 它通过不同的子 agent 在测试任务上练习、复盘失败并提出改进,从而在前一次运行的基础上继续迭代。
- 论文给出的结果显示,在深度研究类基准上,SkillHone 相比最强商业 deep-research agent 提升了 GAIA +15.8 分、WebWalkerQA-EN +3.2 分,以及 工具分析任务 +18.8 分。
- 架构上,它把 agent runtime、优化/评估团队、技能仓库、failure wiki 以及 issue/branch/PR/merge 等仓库操作串成了一个持续决策历史系统。
「编程与Agent」频道最新
- 三星提出 PROGRESS 框架:用覆盖引导强化学习优化 RAG 智能体 — _reachsumit · 2026-08-04
- 研究揭示 RAG 智能体致命缺陷:常跳过阅读证据直接作答 — _reachsumit · 2026-08-04
- Claude 又饿了:开发者吐槽智能体狂吞 10 万个沙盒 — dejavucoder · 2026-08-04
- Search-GRT 用真值文档训练搜索智能体,提升多跳问答 — _reachsumit · 2026-08-04
- HindSearch:利用黄金答案事后复盘,增强搜索智能体训练 — _reachsumit · 2026-08-04
- Numerai 组队做自主量化研究 AI,开放三类岗位 — AndrewCritchPhD · 2026-08-04