新研究警告:加载相关技能可能让 Agent 表现变差

rohanpaul_ai · x · 2026-08-17

一篇新论文实证研究了 LLM Agent 中技能诱导的失败案例。研究控制了模型、框架和代码库,发现即使技能与任务完全相关,仍可能导致 Agent 表现更差。在 307 个失败案例中,主要问题并非技能不相关,而是任务实现错误(86/125)和效率回归(114/182)。论文建议将加载技能视为系统行为变更,需进行对比测试以评估额外开销。

所属事件:微软新研究:Agent技能可能反而有害(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →