思考模式是否在浪费 token?论文作者:取决于任务难度
Jeande_d · x · 2026-08-30
针对「开思考/推理模式是否在浪费 token」的提问,一篇关于推理模型行为论文的作者给出回答:是也不是。
- 对前沿模型(主流厂商公开模型),差异主要取决于任务难度:真正的难题上思考模式帮助很大,因为模型知道如何有效利用额外 token——推演问题、发现错误并修正。
- 而对简单任务,额外思考带来的收益有限,反而消耗更多 token。
- 作者指出聊天界面几乎不告诉用户思考模式何时有用,这正是其论文研究的问题:哪些行为在推理模型中变得更常见、哪些才真正与更好答案相关。
「模型」频道最新
- GLM-5.3-Flash 登顶 Agent Arena 榜单第四 — AccBalanced · 2026-09-01
- 智谱 GLM-5.3 Flash 推出 INT4 与 MXFP4 版本 — HaihaoShen · 2026-09-01
- 南贝格 4.2 3B 模型发布 DSpark 权重 — teortaxesTex · 2026-09-01
- Qwen 2.5 72B 本地实测:长上下文吞吐跌一半 — julianharris · 2026-09-01
- DeepSeek 等模型 SWE-bench 得分辟谣:未达 80% — teortaxesTex · 2026-09-01
- Celeris-1 Magnus 登场:称霸 τ³-bench 的 Agent 专用模型 — timshi_ai · 2026-09-01