研究揭示推理模型「过度思考」:相似提示推理长度差达10倍
wgilpin0 · x · 2026-09-09
作者 wgilpin0 团队在系列推文中展示:推理模型普遍存在「过度思考」现象,两个相似提示词产生的推理轨迹长度可相差 10 倍,直接放大 token 成本。
团队用非线性动力学方法研究推理过程:把「问题+模型权重」参数化为一个动力系统,解就是不动点;对同一问题反复求解、只在初始隐状态上做随机 2D 扰动,发现解的收敛时间在初始条件空间中呈现分形盆地结构。
所属事件:研究用分形盆地理论解释推理模型过度思考(13 条相关)→
「研究」频道最新
- 100 个规则验证器加 300 项任务,团队为视频模型打造可验证 RL 训练配方 — DanielKhashabi · 2026-09-09
- 隐私问题出事才被想起,研究者重提 2022 年差分隐私预训练警示论文 — thegautamkamath · 2026-09-09
- RL 中的局部坏行为不会泛化出「涌现性错位」 — 1a3orn · 2026-09-09
- 思辨:能力 RL 环境中的模型可能学到「能用就用」的最笨启发式 — 1a3orn · 2026-09-09
- 实测拆解 6 年预训练进步:数据贡献 12 倍算力收益,模型仅 3.7 倍 — sebkrier · 2026-09-09
- 论文用知识空间理论测 8 个模型:LLM 数学知识缺乏连贯结构 — dair_ai · 2026-09-09