论文揭示推理模型“思考”行为未必关联正确答案

Jeande_d · x · 2026-08-27

一篇新论文研究了推理模型(Reasoning models)在输出数千 token 的思维链时的行为。研究发现,尽管这些模型在准确率上通常优于其指令微调版本,且表现出自我修正、假设测试等行为,但这些“思考”行为实际上往往与最终答案的正确性关联不大。论文质疑了“思维链能放大最相关推理行为”的假设,指出了当前评估指标(如准确率)无法揭示推理过程中的失败模式。

所属事件:CMU与斯坦福研究:推理模型强化的行为多与正确性无关(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →