新论文发现,推理模型答对后继续想反而会变差
zainhas · x · 2026-07-26
这条帖分享了一篇新论文 《Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models》。论文讨论的是:推理模型并不总是“想得越久越好”,尤其当模型已经找到正确答案后,继续推理可能反而把答案带偏。
从配图中的摘要可以看出,作者主要做了几件事:
- 提出一种 prefix-level trajectory evaluation 方法,用来区分“无害的啰嗦推理”和“有害的过度思考”。
- 发现很多看起来很吃推理的 benchmark,其实在模型答对后并不需要太多额外思考。
- 在首次出现正确前缀时就停止推理,准确率最高可比标准推理提升 21%。
- 早停策略能把啰嗦式过度思考减少 最高 50%,但仍无法完全消除有害 overthinking。
- 误差分析显示,正确性偏移主要来自逻辑漂移和视觉重解释。
- 这些结论不只适用于多模态 benchmark,也能推广到纯语言推理任务。
论文作者包括 Simone Caldarella、Davide Talon、Rahaf Aljundi、Elisa Ricci 和 Massimiliano Mancini。
「研究」频道最新
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- VidMap 用 RoMa 粗匹配全帧、精细匹配仅限关键帧 — ducha_aiki · 2026-09-11
- Bug Hunt Bench 作者补充:榜单噪声幅度约 2-3 分 — PawelHuryn · 2026-09-11
- 台球计算模型登 PNAS:二维系统已存在不可判定性,可跑通用计算机 — eigensteve · 2026-09-11
- 新研究:从仿射变换与重力线索求解绝对位姿 — ducha_aiki · 2026-09-11
- LoMa 论文发布 REALLY HardPairs 数据集,入选 ECCV 2026 — ducha_aiki · 2026-09-11