长时程智能体的真实瓶颈
青稞AI · wechat · 2026-07-21
这篇长文解读了一篇 149 页的长时程智能体综述,核心结论是:Agent 真正的瓶颈不只是单步聪明,而是能否在长链路任务里持续保持目标、记忆和恢复能力。
文章主线
综述把长时程能力拆成两部分共同演化:
- 外部脚手架 / Harness 工程:工作流编排、记忆、工具、技能、hooks、权限与验证。
- 内部模型优化:架构、数据合成、预训练、微调、Agent RL、蒸馏与自进化。
三层能力框架
文章概括了三个层级:
- H1/C1:窗口内的交互式推理。
- H2/C2:跨窗口、跨会话的状态记忆。
- H3/C3:跨任务流的经验积累与持续成长。
关键判断
文中认为,长程任务最常见的失败来自目标漂移、上下文腐化、稀疏延迟奖励、不可逆操作。因此,Agent 竞争越来越像系统工程竞争:不仅看模型能力,更看运行时控制层是否完整。
「编程与Agent」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11