上下文压缩省了 token,却破坏了 AI Agent 可靠性
PepperWestern2263 · reddit · 2026-07-23
这位 Reddit 用户分享了一个很实际的经验:压缩 AI agent 的上下文确实能减少 token 消耗,但也会在一些任务上悄悄降低可靠性。
他把上下文分成三类:
- 可丢弃上下文:重复搜索结果、重复文档、冗长文件列表、啰嗦日志,适合过滤或摘要。
- 承重上下文:精确错误信息、文件路径、行号、patch 锚点、测试名、验收标准。哪怕小改写,也可能让下一步失效。
- 机器消费型上下文:JSON、shell 输出、CSV、patch,或者任何会被别的工具解析的内容。这里最容易因为压缩而出事故。
他的核心结论是:目标不该是“最短上下文”,而该是足够短、但仍保留下一步所需证据和接口的上下文。
最后他也在问:大家在生产环境里是怎么处理这个问题的?是用明确的“禁止摘要”规则,还是依赖 agent 再次检索原始数据?
「编程与Agent」频道最新
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11