研究揭示:自我纠错等推理行为不代表答案正确

zainhas · x · 2026-08-26

一篇新论文分析了 15 个模型在 15,282 条推理轨迹中的行为,发现“推理训练”虽然显著放大了自我纠错、假设测试和承认不确定性行为,但这些行为与正确答案的关联度很弱。相反,置信度校准和知识对齐才是正确性的最强信号,但它们在推理模型中并未得到同等程度的增强。

所属事件:CMU 与斯坦福论文:推理模型强化的行为多与正确性无关(8 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →