SkillHone 为 Agent 保存技能编辑历史避免重复踩坑
机器之心 · wechat · 2026-07-24
SkillHone 把 Agent 的技能优化历史保存下来,避免下一轮重踩旧坑
机器之心介绍了腾讯论文 SkillHone:它不是只优化 SKILL.md,而是把每一轮 Agent 的诊断、候选修改、评估证据和最终决策都持久化下来,让后续优化能继承“为什么这样改”的上下文。
- 现有 Skill 方法往往只保留最终文件,环境一变,下一轮 Agent 只能从结果重来,无法知道前面哪些方案失败、哪些修改已经验证有效。
- SkillHone 将优化过程写成 持久决策历史,后续 Agent 可以检索到每次修改的原因、证据与回退依据。
- 它把优化对象从单个 SKILL.md 扩展到整个 Skill 仓库,也就是脚本、参考资料、模板等都可以一起更新。
- 运行时还做了角色隔离:优化侧只负责改技能,评估侧只负责跑验证和收集证据,避免答案泄漏。
- 论文在 GAIA 和 WebWalkerQA-EN 上展示了明显收益;去掉决策历史后分数大幅下降,说明“记住优化过程”本身就是关键能力。
「编程与Agent」频道最新
- ICAE-Bench 把 coding agent 放进模糊需求做项目场景 — Zhongyuan Peng · 2026-07-24
- Predictive Divergence Masks 让 LLM RL 更新更贴近 trust region — Xiangxin Zhou · 2026-07-24
- 腾讯 WorkBuddy Bench 覆盖代码网页办公与安全评测 coding agent — tencent · 2026-07-24
- NVIDIA 把 LLM agent 直接做成 Python 对象 — nvidia · 2026-07-24
- Claude Code 用户做出 mcp-guard,拦住 MCP 泄露 .env — TastePrestigious4419 · 2026-07-24
- 开发者用 Claude 搭建 3D 城市生成与天气引擎 — repligate · 2026-07-24