97.5% 缓存命中率仍藏一半账单:六 Agent 公司实测省钱 59%
Icy_Comfort_6220 · reddit · 2026-09-11
一位运营「零人类员工」公司(六个 agent 自动产出内容)的作者公开了 Anthropic Console 的真实数据,揭示 token 缓存比率与成本的巨大错位:
- 按 token:97.5% 命中。近 7 天 5600 万 cache reads、140 万 uncached、约 330 万 cache writes;Haiku 4.5 命中率 96.1%,Sonnet 4.6 达 100%,每个写入 token 在过期前平均被读回约 17 次。
- 按成本:几乎五五开。reads 单价 0.1×、uncached 1×、writes 1.25×,那 8% 的写入与未命中 token 吃掉了约一半输入账单——97.5% 的比率掩盖了一半支出。
- 未命中不来自 prompt 变更,而是冷启动:agent 在 5 分钟缓存窗口过期后被定时唤醒、从零重建上下文。改动前 110,081 次调用中 5,278 次(约 5%)零缓存读取。
- 对策与结果:9 月 6 日起降低唤醒频率(研究/写作 agent 改为每 12 小时,其余四个每 6 小时),日支出从 $5.86 降到 $2.39(-59%)。副作用:uncached 占比环比反升 49%——「优化比率会做错决策,要优化成本」。
- 诚实警示:单篇文章成本未降(改动前约 $17,9 月至今单篇 $26),因为产出也从每周两篇降到一篇,月底再验证。
「编程与Agent」频道最新
- 把设计评审交给编码 Agent:一文教你自建 Design Harness — floguo · 2026-09-11
- MCP 生态乱象实锤:Codex OAuth 刷新丢参数,各主机实现一团糟 — max__drake · 2026-09-11
- OnePort 发布:AI 写的代码上线前先查泄密与漏洞,送 10 万积分 — Some_Intention9946 · 2026-09-11
- 让 GLM 5.3 Flash 自主调研游戏 one-shot,48 分钟烧掉 1500 万 token — yeah_likerage · 2026-09-11
- CopilotKit 开源 OpenBot 获 4.7k 星,主打可完全自有的 AI 同事 — Roger_M_Taylor · 2026-09-11
- 开发者借 OpenAI Astra 做出 Three.js 图形 demo:渲染数学门槛正被 AI 拆掉 — algo_diver · 2026-09-11