Agent 为何难以越用越聪明:改进信号与错误发生在不同位置
blaizedsouza · x · 2026-10-02
核心观点
多数 agent 在被使用过程中并没有真正变好,因为“修复”所处的位置和当初“失误”的位置不在同一处,自学习闭环必须刻意弥合这个缺口才算有效。
两种学习信号
- agent 自身的 trace(自己的执行记录)
- 用户的真实行为:点击、修正、工具调用、失败
大多数团队只保存 trace,而把人工修正这一半信号完全丢掉,改进信息就此流失。
三层落地位置
捕获到的经验要存放在某处,作者把模型外围分为三层:
- weights:重训模型,成本最高
- in-context:放进上下文,占用窗口
- harness:工程框架层,是团队真正拥有、无需重训就能塑形的一层
一个修正变三条记忆
以一笔被标记的退款为例:它同时变成一条事实(2000 美元上限)、一个案例(这笔被弹回)和一条规则(批准并打标)。单一用户修正在 harness 层可以被结构化为多种知识复用。
「编程与Agent」频道最新
- Claude Code 搭配 Opus 5.5 体验转好,开发者称此前偏见作祟 — Angaisb_ · 2026-10-02
- NYT 编辑:AI 擅长写代码的原因恰是它写不好文章 — dylfreed · 2026-10-02
- 用 AI 做游戏开发:开发者从写代码转向测试与指导 — AIandDesign · 2026-10-02
- Agent-Reach 等 3 个开源工具详解:让 Agent 抓取任意网站数据 — FinanceYF5 · 2026-10-02
- 3 个开源工具让 AI Agent 抓取全网数据,连无 API 网站也不放过 — FinanceYF5 · 2026-10-02
- 一条 prompt 让 Claude Opus 5.5 自主拍出 5 分半 AI 恐怖短片 — Cheap_Credit_3957 · 2026-10-02