CMU研究:推理训练放大自我修正而非置信度校准
CarnegieMellonU · hf · 2026-08-17
卡内基梅隆大学的研究探讨了“思考模型”中的推理行为。研究发现,推理训练主要放大了自我修正等深思熟虑的行为,但并没有显著提高置信度校准等高正确率行为。这揭示了被放大的推理模式与正确性相关的推理模式之间存在差距。
「研究」频道最新
- Scott Aaronson 评 AI 数学突破:别再急着立里程碑了 — dilipkay · 2026-08-17
- 微软研究:4B 小模型经 SocialRL 训练,谈判能力反超 GPT-5 系列 — dair_ai · 2026-08-17
- 数学成本骤降,用定理验证替代实验探索 Transformer — DimitrisPapail · 2026-08-17
- AI 结合数据科学:向实时预测洞察演进 — mdancho84 · 2026-08-17
- 递归自我改进难度被低估,AI 难产新创意 — sarahcat21 · 2026-08-17
- Pathway 小模型打破 ARC-AGI 成本效率纪录 — dank_philosopher · 2026-08-17