研究揭示:自我纠错等推理行为不代表答案正确
zainhas · x · 2026-08-26
一篇新论文分析了 15 个模型在 15,282 条推理轨迹中的行为,发现“推理训练”虽然显著放大了自我纠错、假设测试和承认不确定性行为,但这些行为与正确答案的关联度很弱。相反,置信度校准和知识对齐才是正确性的最强信号,但它们在推理模型中并未得到同等程度的增强。
所属事件:CMU 与斯坦福论文:推理模型强化的行为多与正确性无关(8 条相关)→
「研究」频道最新
- 开源 RL 论文遭质疑:centering 修正被指只是重算采样分布梯度 — burny_tech · 2026-09-23
- 观点:当 AI 科学与人类科学像数学一样走向分叉 — burny_tech · 2026-09-23
- 物理学会首测 ν=1/2 分数量子霍尔态电荷,达 e/4 — burny_tech · 2026-09-23
- 2026 年 arXiv 数学提交量激增 33.5%,30 个子领域 29 个增长 — rohanpaul_ai · 2026-09-23
- Mixture-of-Depths:让Transformer按token动态分配算力 — burny_tech · 2026-09-23
- Theorem 创始人:AI 已攻克形式验证最难的一环 — burny_tech · 2026-09-23