Agent 上下文太长怎么管
Kevin_Dong_cn · reddit · 2026-07-11
帖子在问:做 agent conversation context 时,如何管理每轮工具调用产生的大量上下文数据。 作者目前只保留用户问题、工具名和答案,不直接塞完整 tool output,因为 schema 结果和查询可能太长;但如果把工具历史和输出都带上,又会迅速膨胀,到了第 5 轮上下文就可能达到 **100 万 token**。他想了解社区里大家通常怎么做上下文压缩、截断或存储管理。
所属事件:开发者讨论数据Agent的上下文膨胀(2 条相关)→
「Infra」频道最新
- 一张图对比:Moonshot 在养心智,DeepSeek 在建电网 — teortaxesTex · 2026-07-21
- FlashRT:利用智能体优化多模态应用部署,B200延迟降低70倍 — Krish Agarwal · 2026-07-21
- Reddit 用户设计四层本地 AI 机房:vLLM 到 OPNsense 全分层 — povedaaqui · 2026-07-21
- 现货内存价飙升 140%,合约重定价开始滞后 — tengyanAI · 2026-07-21
- 有人把 AI 使用方式指向异步长周期实验而非单买算力 — voooooogel · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21