为什么多数 Agent 学不到东西:有记忆不等于会学习
anirudhg9119 · x · 2026-10-09
作者以 Claude Fable 5 在国际象棋上的自我改进为例:当一局在 300-ply 上限记 0 分后,agent 会修改自己的引擎去重视和棋,后续 checkpoint 甚至能顶住 Stockfish 直到被将死——这是从经验中修出来的策略。
作者指出关键线索:很多 agent 不进步是因为不复用学到的东西;但仅靠复用也不够——四个模型在相关决策中有 94–98% 都在复用 artifacts,收益却差异巨大,甚至强改进者也经常在使用 artifact 时失败。结论:有记忆 ≠ 有效学习。
所属事件:为何多数智能体难以从经验中提升:复用不等于学习(2 条相关)→
「编程与Agent」频道最新
- 用 AI 一小时搭出带 Salesforce 链接的定制销售仪表盘 — thisiskp_ · 2026-10-09
- Nvidia 论文:训练与改技能文件交替进行,Agent 提分最显著 — rohanpaul_ai · 2026-10-09
- 开发者称 ultrafast 改变心流:专注单任务即时迭代 — Dimillian · 2026-10-09
- GPT-6.1 Sol ultrafast 实测:比标准模式快 8 倍写 SwiftUI — Dimillian · 2026-10-09
- 开发者自建 Gmail AI 回复助手:靠记忆工具越用越准 — Al_Grigor · 2026-10-09
- 新论文提出 Agent Plasticity:衡量智能体从经验中自我改进的效率 — anirudhg9119 · 2026-10-09