OpenAI 改进 GPT-6 Prompt 缓存,输入 token 最高省 90%
OpenAI 宣布改进 API 中 GPT-6 的 prompt caching,默认更高的缓存命中率使 agent 运行更快、成本更低,输入 token 消耗最高可节省 90%。配套推出的 Prompt Caching Dashboard 让开发者查看哪些内容被复用、哪些改动导致缓存失效。新工具集还支持显式缓存断点选择复用的 prompt 前缀、在保留缓存上下文的同时调整推理力度和工具可用性,以及预热共享上下文以加快响应。
2026-09-23 ~ 2026-09-23 · 3 条相关
- OpenAI 改进 GPT-6 Prompt 缓存:输入 Token 最高省 90% — OpenAIDevs · 2026-09-23
- OpenAI 上线 Prompt 缓存仪表盘:可查缓存命中率与失效原因 — OpenAIDevs · 2026-09-23
另有 1 条近重复转述:OpenAIDevs