GPT-5.6缓存计费疑似异常
ClassicMain · reddit · 2026-07-11
一位开发者发现,GPT-5.6 家族的 prompt caching 似乎存在异常:
- 他在原始 api.openai.com 上用两次完全相同的请求复现,cachewritetokens 会在第一次出现,但后续请求的 cachedtokens 始终是 0。
- 这意味着系统似乎知道前缀已缓存、也没有重复写入,但读取侧没有拿到应有的缓存抵扣。
- 他还提到,在同一组织里对比 GPT-5.5,后者的缓存读取计费看起来仍正常。
- 帖子里甚至附了一个最小复现:两次 curl、间隔 30 秒即可看到异常。
作者的结论是:如果这不是仅仅 usage 统计显示问题,那么在 GPT-5.6 上启用缓存可能会比不用还差,至少在他们的生产路由里已经先回退到 GPT-5.5。
「模型」频道最新
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11