实测发现:设 reasoning effort 为 none,压缩上下文仍消耗推理 token

mhmazur · x · 2026-09-04

作者在用 OpenAI Provider Adapter 测试 ARC-AGI-3 时发现:即使 API 请求中把 reasoning effort 设为 "none",模型在上下文窗口压缩(compaction)时仍会使用推理 token。这些 token 反映的是模型在决定保留哪些上下文、状态与既有推理的内部工作,而非对具体游戏动作的推理。

另一个细节:当设置了非 none 的推理等级且触发自动压缩时,API 的 usage 数据并不区分「用于压缩的推理 token」和「用于决策的推理 token」。作者认为多数场景不需要区分,但对做深度数据分析的人而言,这种可见性会很有价值。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →