OpenAI 改进 GPT-6 Prompt 缓存:输入 Token 最高省 90%

OpenAIDevs · x · 2026-09-23

OpenAI 官方开发者账号宣布改进 API 中 GPT-6 的 prompt caching(提示词缓存),让 agent 运行更快、成本更低。默认更高的缓存命中率意味着更多输入 token 可享受最高 90% 的缓存输入折扣,对高频调用和多轮 agent 场景是直接的降本利好。

所属事件:OpenAI 改进 GPT-6 Prompt 缓存,输入 token 最高省 90%(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →