新研究发现,Agent 技能在 5832 次运行中带来 59% 回归税
TheTuringPost · x · 2026-07-28
研究发现:给 Agent 加技能,可能带来 59% 的回归税
这篇论文讨论的是 LLM agent 加入 procedural skills 之后的副作用,而不只是平均分提升。作者在 5,832 次办公任务运行中观察到 553 次提升,但也出现了 324 次回归,相当于 59% 的回归税。
论文把回归原因拆成三类:
- skill-description osmosis:即使技能没被真正调用,只要描述出现在上下文里,也可能改变 agent 行为
- grounding displacement:技能里的流程会覆盖 agent 原本对输入的理解
- verification displacement:技能流程会压制 agent 原本会做的检查
作者结论是:只看平均分不够,评估 skills 时必须同时看它修复了什么、破坏了什么,以及“只放进上下文”是否就已经改变了行为。
所属事件:研究揭示 Agent 技能引入会带来 59% 回归税(2 条相关)→
「编程与Agent」频道最新
- Agent 架构法则:验证器可参与生成反馈,但不得直接晋升候选解 — blaizedsouza · 2026-09-23
- Drew Breunig:写 Agent 指令更像立法,而非下棋 — dbreunig · 2026-09-23
- Seroter 日报:GPT-6 与 Opus 5.5 同日发布,1/4 智能体无人监控 — rseroter · 2026-09-23
- 让 Claude 自动开终端面板装依赖,作者称 tmux 做不到 — letandrewcook · 2026-09-23
- 两小时做出幼儿互动绘本:Agent 访谈式工作流走红 — mimi10v3 · 2026-09-23
- 观点:软件正从"被人操作"变为"自己会用软件" — r0ck3t23 · 2026-09-23