一个查询花掉 $3.64:实测 agent 用按量计费 API 的失控与四条防线
GoldBroccoli7073 · reddit · 2026-09-11
一位开发者让 agent「查查大家在讨论 MCP servers 的什么」,结果 X API 账单 $3.64:300 条帖子按条计费 + 214 个用户查询,每一步单独看都合理,但没有任何机制告诉模型它花了多少钱。
核心反直觉点:reads 按返回资源数计费而非按请求数,maxresults=100 与 5 是同一次请求,价格却差 20 倍($0.50 vs $0.025),响应里也不含成本信息。
作者总结了四条可复用的设计原则,适用于任何接给模型的按量计费 API:
- 把价格写进工具描述:模型每次调用前都会读,明说「按返回条数计费,尽量要最小数量」,实测显著改变默认行为;
- 先免费估算规模:用 X 的 counts endpoint 先看命中量再决定是否付费,免费的「这一步多少钱」工具比便宜 10% 的工具更有价值;
- 批量代替循环,绝不自行分页:一次 lookup 可带 100 个 id,agent 自己翻 nexttoken 等于给自己开空白支票;
- 配置层硬性 clamp:所有参数先取默认值再压缩进 [min,max],上限来自模型看不到的环境变量,省略参数时回落到默认值 10 而非最大值。
作者强调分工:描述让模型「想要」便宜的做法,配置让贵的事不可能发生。仍未解决的问题:server 内没有 per-session 花费上限,模型仍可拿 nexttoken 反复调用,目前只能靠提供商侧的预算控制兜底。
「编程与Agent」频道最新
- Every 给每位员工建个人基准,实测发现小模型更能干日常活 — every · 2026-09-11
- Agent 一天替主人交税点外卖,追回 836 美元无主财产 — armand_ruiz · 2026-09-11
- OpenAI Agents API 被称作「Agent 界的 AWS 时刻」,困难部分全变成租用 — TheMoonMidas · 2026-09-11
- Codex 20x 额度性价比下滑,用户换用 Grok 4.6 xhigh — mazzaTalk · 2026-09-11
- 开发者发布仅三工具的 MCP 服务器,让 Agent 把 Markdown 安全推到浏览器 — Hopeful-Business-15 · 2026-09-11
- 两天高强度实测 Cursor:搭配 grok 4.6 xhigh 完成一般任务 — mazzaTalk · 2026-09-11