CMU研究:推理训练放大自我修正而非置信度校准

CarnegieMellonU · hf · 2026-08-17

卡内基梅隆大学的研究探讨了“思考模型”中的推理行为。研究发现,推理训练主要放大了自我修正等深思熟虑的行为,但并没有显著提高置信度校准等高正确率行为。这揭示了被放大的推理模式与正确性相关的推理模式之间存在差距。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →