实测发现:Gemini 对思考 token 另行计费,OpenAI 则包含在输出内,算错差 5 倍
qaiser_mehdi · reddit · 2026-09-07
一位开发者在做成本计量工具时实测了各家的思考 token 计费口径,发现三家厂商采用了两种截然相反的约定:
- Google:对 gemini-3.6-flash 三次调用验证,thoughtstokencount 完全不包含在 candidatestokencount 内,是额外计费。某次调用中思考 token 占 750 总 token 的 589 个(79%),只按 output 144 计价会低估约五分之四的真实成本。
- OpenAI:reasoningtokens 是 completiontokens 的子集,相加会重复计算。
- Anthropic:不单独报告思考 token,直接并入 outputtokens。
三家都不会在算错时报错。作者只测了一个模型的免费额度三次调用,已开源验证脚本(用 AI Studio 免费 key 即可复现),并询问还有哪家厂商采用 Google 式计法。
「模型」频道最新
- GPT-6 Astra high 档几小时内把延迟从 30 秒压到 11 秒 — BLUECOW009 · 2026-09-07
- GPT-6 Astra 纯 three.js 复刻希克苏鲁伯撞击动画,被称研究能力怪兽 — omarsar0 · 2026-09-07
- OpenAI 研究员称本可大幅提升模型数学能力,只是没做 — JeffLadish · 2026-09-07
- 网友实测:一句话让 GPT-6 Astra 自建 Minecraft 代理并剪出展示视频 — Angaisb_ · 2026-09-07
- 数学家实测最新推理模型:自研难题 Sol 5.6 与 Fable 5.1 均无解 — burny_tech · 2026-09-07
- 用户称赞 OpenAI 提供 3 次额度重置的设计 — shekitup · 2026-09-07