实测发现:设 reasoning effort 为 none,压缩上下文仍消耗推理 token
mhmazur · x · 2026-09-04
作者在用 OpenAI Provider Adapter 测试 ARC-AGI-3 时发现:即使 API 请求中把 reasoning effort 设为 "none",模型在上下文窗口压缩(compaction)时仍会使用推理 token。这些 token 反映的是模型在决定保留哪些上下文、状态与既有推理的内部工作,而非对具体游戏动作的推理。
另一个细节:当设置了非 none 的推理等级且触发自动压缩时,API 的 usage 数据并不区分「用于压缩的推理 token」和「用于决策的推理 token」。作者认为多数场景不需要区分,但对做深度数据分析的人而言,这种可见性会很有价值。
「模型」频道最新
- OpenAI 发布 GPT-6 Astra:电脑上能做的事它都能替你做 — rounak · 2026-09-05
- Ollama CEO:开源模型已可行,云上 token 用量年内暴涨 150 倍 — ycombinator · 2026-09-05
- LMArena 图像编辑排行榜上线,可对比各模型修图能力 — arena · 2026-09-05
- Claude 太贵,知识工作者求推荐长上下文强指令跟随的替代模型 — SemiMagnum · 2026-09-05
- Every 团队直播实测 Anthropic Fable 5.1 与 OpenAI GPT-6 Astra — danshipper · 2026-09-05
- 用户实测质疑 Artificial Analysis 榜单:高分模型实战远逊 Opus — PerformanceRound7913 · 2026-09-05