Agent 上下文太长怎么管

Kevin_Dong_cn · reddit · 2026-07-11

帖子在问:做 agent conversation context 时,如何管理每轮工具调用产生的大量上下文数据。 作者目前只保留用户问题、工具名和答案,不直接塞完整 tool output,因为 schema 结果和查询可能太长;但如果把工具历史和输出都带上,又会迅速膨胀,到了第 5 轮上下文就可能达到 **100 万 token**。他想了解社区里大家通常怎么做上下文压缩、截断或存储管理。

所属事件:开发者讨论数据Agent的上下文膨胀(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →