Anthropic 缓存误用会更费钱
KitchenAmoeba4438 · reddit · 2026-07-18
作者在排查 Anthropic API 账单偏高后,发现一个容易被误解的点:Anthropic 有自己的缓存机制,只有消息内容与之前的内容“完全一致”时,才可能命中缓存并按缓存 token 计费。
他据此认为,很多会“压缩上下文”的插件在 Anthropic 场景下反而可能更贵:
- 一旦插件需要“rehydrate”上下文,可能先额外消耗 token
- 只要它改变了 Anthropic provider 期待的缓存结构,就可能失去缓存 token,转而按更贵的普通 token 计费
- 不同 provider 对 Anthropic 的缓存实现也不一样,进一步增加了复杂度
结论是:想在 Anthropic API 上省 token 并不简单,某些看似节省上下文的工具,实际可能让账单更高。
「编程与Agent」频道最新
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11
- 拆解两款真实「公司大脑」:Slite 与 Gorgias 同台对比构建之道 — femke_plantinga · 2026-09-11