为什么多数 Agent 学不到东西:有记忆不等于会学习

anirudhg9119 · x · 2026-10-09

作者以 Claude Fable 5 在国际象棋上的自我改进为例:当一局在 300-ply 上限记 0 分后,agent 会修改自己的引擎去重视和棋,后续 checkpoint 甚至能顶住 Stockfish 直到被将死——这是从经验中修出来的策略。

作者指出关键线索:很多 agent 不进步是因为不复用学到的东西;但仅靠复用也不够——四个模型在相关决策中有 94–98% 都在复用 artifacts,收益却差异巨大,甚至强改进者也经常在使用 artifact 时失败。结论:有记忆 ≠ 有效学习。

所属事件:为何多数智能体难以从经验中提升:复用不等于学习(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →