同文不同价:OpenAI 专家揭秘分词器差异如何致 API 账单差三成
新智元 · wechat · 2026-08-19
OpenAI Codex 负责人 Tibo 指出,不同模型的分词器效率差异巨大,同一段文本 GPT-5.6Sol 切出 766 个 token,而 Claude Opus 5 切出 1170 个。这意味着即便单价相同,低效分词器的实际账单可能高出 34.5%。
除分词效率外,影响真实成本的还有四点:
- 缓存:GPT-5.6Sol 缓存输入价仅为标准的十分之一。
- 输出成本:GPT 输出 30 美元/百万,Claude 25 美元起,智能体工作流中输出权重高。
- 长上下文倍率:GPT-5.6Sol 超过 272K token 时,输入计价翻倍,输出 1.5 倍。
- 有效窗口:实测显示 Codex 客户端窗口限制远低于标称值,需手动修改配置文件解锁 1M 窗口。
Tibo 建议,应关注“每次成功结果的成本”而非单 token 价格,需结合自身负载实测分词、缓存、输出和倍率,计算总账单。
「Infra」频道最新
- 中国建成全球最大单体 AI 园区,欲容纳百万 GPU — teortaxesTex · 2026-08-19
- 美银预言美数据中心三年需 68GW 电力,缺口达 38GW — tctjr · 2026-08-19
- MacBook 本地跑 AI 应用零边际成本,MLX 生态远未消亡 — cocktailpeanut · 2026-08-19
- 宾州州长签署行政令,实施全美最严AI数据中心标准 — TinfoilTricorn · 2026-08-19
- 开源 RL 框架 Miles v0.1 发布,简化大模型强化学习训练 — ying11231 · 2026-08-19
- GitHub流量爆增或因Agent泛滥,仅付费托管恐非解药 — steipete · 2026-08-19