新论文发现,推理模型答对后继续想反而会变差

zainhas · x · 2026-07-26

这条帖分享了一篇新论文 《Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models》。论文讨论的是:推理模型并不总是“想得越久越好”,尤其当模型已经找到正确答案后,继续推理可能反而把答案带偏。

从配图中的摘要可以看出,作者主要做了几件事:

论文作者包括 Simone Caldarella、Davide Talon、Rahaf Aljundi、Elisa Ricci 和 Massimiliano Mancini。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →