长文拆解:压缩 token 可能让 OpenAI 账单更高
KitchenAmoeba4438 · reddit · 2026-07-22
- 这篇 Reddit 长文的核心结论是:压缩 token 的工具不等于省钱,在 OpenAI API 上尤其如此。
- 作者指出,到了 GPT-5.6,cache write 的成本是普通输入的 125%,而 cache read 只要 10%;如果压缩改动了原本已缓存的前缀,反而可能比复用缓存更贵。
- 文章给出的经验阈值是:一次改动至少要删掉 92% 以上 被失效的后缀,下一次请求才可能回本。
- 对 RTK 的分析认为,它看到的“省了多少 token”并不等于真实账单,因为它看不到 API 计费、cache state 和 breakpoint;作者提到的独立 benchmark 里,RTK 虽然声称节省了 9620 万 tokens,但实际账单却 上涨了 7.6%。
- 对 Headroom 的判断更复杂:它理论上能代理真实请求、只压缩新工具输出,但当前实现似乎还跟不上 GPT-5.6 的显式 breakpoint 和写入溢价,账单面板不宜直接当作真实成本账。
- 文章最后强调,真正要看的是 每次成功任务的成本,而不是工具页面上的 token 数。
「Infra」频道最新
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11