Ploy 迁移 agent 到 GPT-5.6:调整上下文结构配合 KV 缓存大幅降本

HistoricalTerm1570 · reddit · 2026-09-28

公司 Ploy 在把生产环境 agent 迁移到 GPT 5.6 时发现,针对 KV caching 优化上下文组织方式,能显著降低 agent 运行成本。原理是让多次请求间共享尽可能长的稳定前缀,命中缓存后输入 token 按缓存价计费,远低于普通输入价。素材来自 OpenAI 官方播客,发帖人表示这是新学到的实用知识。对跑多轮 agent 的团队,提示词与上下文排序的微调即可带来可观的账单差异。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →