微软新论文揭示:Agent技能库并非免费,错误指导暗藏高昂代价

omarsar0 · x · 2026-08-13

当前主流的 Agent 测试框架普遍依赖技能库来提供额外指导,并默认这种指导是无成本的。然而,微软及合作团队的一项新研究量化了糟糕技能带来的实际代价。

研究人员将 307 次 Agent 失败归因于特定的已加载技能(包含 125 次功能性失败和 182 次效率倒退),他们通过将每次技能指导的运行与解决相同任务的参考运行进行对比得出该结论。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →