Anthropic 称 Prompt Caching 可把重复上下文成本降至九折
aitrendz_xyz · x · 2026-07-27
这条重点讲 prompt caching:如果 API 应用里有大量重复上下文,反复重算会很贵;把内容标记为缓存后,后续请求会复用服务端缓存,号称可让缓存 token 最多便宜 90%,同时更快。
帖子还给出具体规则:缓存持续 5 分钟,每次使用会刷新;可用于 system prompt、文档和工具定义,但内容块必须达到最小长度阈值——Sonnet 需要 1,024 token,Opus 和 Haiku 需要 4,096 token,否则不会缓存。
所属事件:Anthropic 推出 Claude 工作流套件强化生产力(3 条相关)→
「编程与Agent」频道最新
- Alchemy 新增 Kubernetes 文档中心,从 kind 集群到 EKS 部署全流程 — samgoodwin89 · 2026-09-23
- Rat Stack:把应用和云写成一个类型化程序,让 AI agent 可靠地搭建部署 — samgoodwin89 · 2026-09-23
- 「还记得 Tab 补全吗」:编码方式两年间的狂飙变迁 — yoobinray · 2026-09-23
- 调查:1/4 的 AI Agent 处于无人监控状态 — rseroter · 2026-09-23
- 警惕「提示词债务」:自然语言不是可靠的系统规格语言 — dbreunig · 2026-09-23
- Massive 联手 Coinbase,AI Agent 可付费获取实时市场数据 — kleffew94 · 2026-09-23