Codex 用量暴涨原因解析
jasondeanlee · x · 2026-07-14
这条转发围绕 Codex 的计费与子代理行为 解释了一个用户看到用量“被打爆”的原因:
- 长上下文计费问题:有说法称 gpt-5.6 在超过 272k tokens 后会变成 2 倍成本,但被引用内容指出,订阅侧并不是简单按更长上下文直接翻倍收费,真正原因另有其事。
- 模型轨迹长度:整体 trajectory length(跨多次 compaction 的上下文总和)受 reasoning effort 影响不大,输出质量在超过 272k 上下文后也差别不明显。
- 长上下文的价值:更高上下文主要带来三类收益:
- 更快,因为不必频繁 compaction;
- 能处理超大输入;
- 在系统调得好、缓存命中理想时,可能更省成本。
- 用量暴涨的叠加原因:另一条引用提到,Codex 里几个问题叠在一起导致用量/费用异常:
- gpt-5.6 在 272k 以上成本变高;
- Ultra 子代理会继续派生 Ultra,造成嵌套子代理消耗;
- Sol 和 Terra 走的是仍在早期的 v2 子代理层,会复制完整长上下文而不是新历史。
整体是在讲 Codex 这类编程智能体的上下文、子代理和计费实现细节,以及这些设计如何共同放大 token 消耗。
「编程与Agent」频道最新
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 投资分析师求教:如何用 Claude 搭建尽调 Agent 工作台 — Careless_Tie2286 · 2026-09-11
- 把 Agent 当失忆症患者:三层上下文分层法让对话不再从零开始 — evielync · 2026-09-11
- Android 手机跑 Firefox MCP:Termux+ngrok 完整教程 — Nervous-Strain7544 · 2026-09-11