新论文发现,推理模型答对后继续想反而会变差
zainhas · x · 2026-07-26
这条帖分享了一篇新论文 《Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models》。论文讨论的是:推理模型并不总是“想得越久越好”,尤其当模型已经找到正确答案后,继续推理可能反而把答案带偏。
从配图中的摘要可以看出,作者主要做了几件事:
- 提出一种 prefix-level trajectory evaluation 方法,用来区分“无害的啰嗦推理”和“有害的过度思考”。
- 发现很多看起来很吃推理的 benchmark,其实在模型答对后并不需要太多额外思考。
- 在首次出现正确前缀时就停止推理,准确率最高可比标准推理提升 21%。
- 早停策略能把啰嗦式过度思考减少 最高 50%,但仍无法完全消除有害 overthinking。
- 误差分析显示,正确性偏移主要来自逻辑漂移和视觉重解释。
- 这些结论不只适用于多模态 benchmark,也能推广到纯语言推理任务。
论文作者包括 Simone Caldarella、Davide Talon、Rahaf Aljundi、Elisa Ricci 和 Massimiliano Mancini。
「研究」频道最新
- 实测智能体数据科学工作流:代码能跑但常答错问题 — hugobowne · 2026-07-27
- 一份横跨 ML、系统、NLP 与音频的经典论文清单 — deliprao · 2026-07-27
- TechCrunch 讨论脑波信号或成 physical AI 训练新钥匙 — TechCrunch AI · 2026-07-27
- NeurIPS 反驳阶段临近:如何写出高质量回复? — furongh · 2026-07-27
- 一篇名为“在康托空间没人听见你流”的计算机论文 — fkasummer · 2026-07-27
- YC 讨论具身机器人:预训练、记忆和组合行为才是关键 — ycombinator · 2026-07-27