OpenAI Boosts GPT-6 Prompt Caching, Input Tokens Now Up to 90% Cheaper

OpenAIDevs · x · 2026-09-23

OpenAI's official developer account announces improved prompt caching in the API for GPT-6, helping agents run faster and cost less. Higher cache-hit rates by default mean more input tokens benefit from cached-input discounts of up to 90%.

Related event: OpenAI improves GPT-6 prompt caching with up to 90% input token savings(3 posts)→

Original post →

More from Models

Models channel →