22022 次 API 调用实测:Fable 5.1 单次调用 token 多 31%,但便宜 31%
tenequm · reddit · 2026-09-03
作者用自建会话归档工具 pond 汇总 21 天、22,022 次 API 调用,逐 prompt 对比 Claude Fable 5 与 5.1 的成本。
核心数据
- 5.1 单次 prompt 消耗 token 比 5 多约 31%(主要是 cache reads)
- 但 5.1 对缓存读取只按 25% 计费,单 prompt 平均成本从约 $1.52 降到 $1.05,便宜约 31%
限额为何更快耗尽? 作者提出三个无法从 transcript 自测的猜想:
- 订阅计划的限额计算可能未计入 5.1 的缓存读取折扣
- 5 小时窗口占全周比例可能从 1/6 改为 1/5
- effort 参数在 5.1 上影响可能不同
可操作建议
- 官方 Prompting 指南指出 5.1 倾向每轮只发一个工具调用而不批量,可在提示词中加入「先私下列出下一步所需项,再在一次响应中请求所有不依赖前置结果的项」来引导其批量调用
- 作者已把该 nudge 加入自己的 CLAUDE.md
作者表示愿意分享查询语句,供他人在自己的 l transcript 上复现分析。
「编程与Agent」频道最新
- 为 Linux 版 Copilot 修复拖拽:开发者自建 WebKitGTK 补丁并打包 Flatpak — unixterminal · 2026-09-05
- Nous Research Hermes 桌面端支持组建专家 Agent 舰队并互相通信 — Teknium · 2026-09-05
- 别读思维链了:直接监控 Agent 的输入输出才更可靠 — nicolascraske · 2026-09-05
- 语音 Agent 测试工具横评:Cekura、Cyara、TestMu 到底差在哪 — Fishful_Revenge · 2026-09-05
- LinkedIn 工程副总裁拆解 Hiring Assistant:招聘痛点在流程割裂 — CodeByPoonam · 2026-09-05
- Agent 框架只占问题一成,状态管理才是生产环境真正杀手 — Deepfeet-09 · 2026-09-05