研究:蒸馏 SKILL.md 比工作流记忆高 6.06 分,技能靠稳定执行起效
rohanpaul_ai · x · 2026-09-08
对比实验显示,让智能体消化同样历史轨迹时,蒸馏成 SKILL.md 的技能版本比保留更多执行细节的 Workflow Memory 高出 6.06 个百分点——提升不来自更多经验,而是同样的经验被打包得更好。
轨迹分析揭示了机制:65.7% 的技能成功案例源于「程序化锚定」(procedural anchoring),即技能帮助智能体确定执行顺序、工具选择与验证步骤;只有 4.5% 是靠注入缺失知识。技能主要解决「怎么执行」,而非「不知道什么」。
这也解释了失效模式:技能在不合适的场景被使用、或被过于机械地遵循时,反而会拖累表现。作者结论:自我改进型智能体需要的是更好地蒸馏和应用经验,而不是更大的记忆库。
所属事件:8135 次实验解密 Agent Skills 的有效与失效边界(2 条相关)→
「编程与Agent」频道最新
- DHH 的 Omarchy Linux 获 1550 万美元成立基金会,主打智能体排障 — vista8 · 2026-09-08
- CROCODIL 解决多 LLM 协作时「过度修改无关代码」问题 — jessyjli · 2026-09-08
- 用 Grok Bot 在 Figma 自动生成三联照片马赛克,设计苦活省 90% — mattyp · 2026-09-08
- x402 让智能体学会经济推理:每次调用都带价格标签 — kleffew94 · 2026-09-08
- 用 qwen3.8:27b 给小说做连续性审校,顺手造了个 git hook — walkingriver · 2026-09-08
- 开源 CLI hangnone:静态扫描 CI 里会卡死或静默失败的 Claude Code 调用 — Obluness · 2026-09-08