研究提出 Agent 上下文管理框架,缓解记忆和成本失控
rohanpaul_ai · x · 2026-07-25
把 Agent 记忆当成“生命周期管理”来做
这篇论文的核心观点是:生产级 AI agent 的失败,往往不是因为推理不够强,而是因为它们不会管理上下文。作者认为,记忆不应只被看成“存储与检索”,而应被拆成一套生命周期管理:决定什么该记、何时取、给谁看、先准备什么,以及如何安全压缩。
论文提出 Agentic Context Management(ACM),包含五个环节:架构设计、摄入、范围界定、提前预判、压缩整理。参考实现 Maximem Synap 会把原始活动转成结构化事实,维护上下文边界,沿着证据链追踪信息,提前准备下一步可能需要的内容,并检查压缩后是否丢失关键信息。
文中给出的结果是:在 LongMemEval 上拿到 92%,在 LoCoMo 1–4 类上拿到 93.2%,但多轮跨会话推理仍是最弱项。作者还强调,直接把所有历史都塞进上下文会让 token 成本随对话长度近似平方增长;而经过验证的压缩机制,才能把成本更接近地控制在线性增长。
所属事件:研究指出上下文失控是生产级 Agent 失败主因(2 条相关)→
「编程与Agent」频道最新
- 未来 30 到 60 天会热起来的四个 AI 词 — arieljalali · 2026-07-25
- Modern Relay 认为 agent 协调需要类型图而非 Postgres — sarahdrinkwater · 2026-07-25
- Pydantic Monty 新增子进程、Rust 发布和 WebSocket 支持 — samuelcolvin · 2026-07-25
- 很多 agent 失败,不是不会做而是不知道在推进 — orvi2014 · 2026-07-25
- 有人在做统一调试多步 AI 工作流的工作台 — Impressive-Iron5216 · 2026-07-25
- Laguna S 2.1:用户想要开源和更简单的编程智能体 — max_paperclips · 2026-07-25