研究:蒸馏 SKILL.md 比工作流记忆高 6.06 分,技能靠稳定执行起效

rohanpaul_ai · x · 2026-09-08

对比实验显示,让智能体消化同样历史轨迹时,蒸馏成 SKILL.md 的技能版本比保留更多执行细节的 Workflow Memory 高出 6.06 个百分点——提升不来自更多经验,而是同样的经验被打包得更好。

轨迹分析揭示了机制:65.7% 的技能成功案例源于「程序化锚定」(procedural anchoring),即技能帮助智能体确定执行顺序、工具选择与验证步骤;只有 4.5% 是靠注入缺失知识。技能主要解决「怎么执行」,而非「不知道什么」。

这也解释了失效模式:技能在不合适的场景被使用、或被过于机械地遵循时,反而会拖累表现。作者结论:自我改进型智能体需要的是更好地蒸馏和应用经验,而不是更大的记忆库。

所属事件:8135 次实验解密 Agent Skills 的有效与失效边界(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →