Anthropic 称 Prompt Caching 可把重复上下文成本降至九折
aitrendz_xyz · x · 2026-07-27
这条重点讲 prompt caching:如果 API 应用里有大量重复上下文,反复重算会很贵;把内容标记为缓存后,后续请求会复用服务端缓存,号称可让缓存 token 最多便宜 90%,同时更快。
帖子还给出具体规则:缓存持续 5 分钟,每次使用会刷新;可用于 system prompt、文档和工具定义,但内容块必须达到最小长度阈值——Sonnet 需要 1,024 token,Opus 和 Haiku 需要 4,096 token,否则不会缓存。
「编程与Agent」频道最新
- 用 MCP 把 Blender 接 Claude,一小时做出游戏原型 — danbri · 2026-07-27
- Anthropic 推出 Claude 工作流套件:缓存、代码、设计、技能和定时任务 — aitrendz_xyz · 2026-07-27
- Claude Design 面向提案和原型,可导出 PPTX 与 HTML — aitrendz_xyz · 2026-07-27
- CLAUDE.md 让项目规则、文风和术语跨会话生效 — aitrendz_xyz · 2026-07-27
- Anthropic 的 Skills 把能力打包,任务匹配就自动启用 — aitrendz_xyz · 2026-07-27
- 有人提议 Cursor 直接把 Grok Build 当作后端 — Daniel_Farinax · 2026-07-27