Meta 发现:量化推理模型常在答对后又开始怀疑
rohanpaul_ai · x · 2026-07-22
Meta 这篇论文指出,量化后的推理模型失败,很多时候不是因为想不出答案,而是因为已经想对了却又开始怀疑自己。作者认为,后训练量化会在生成过程中放大某些犹豫词的出现概率,比如 “wait”“but”“alternatively”,从而让模型在答案已经接近完成时重新打开问题。
论文在 5 个推理模型、多种量化方法、以及 1.5B 到 32B 的模型规模上,覆盖数学、代码和科学任务进行实验。主要结论是:
- 激进量化会让过度思考类失败最多上升 52%。
- 只要对 50 个犹豫词加一个小惩罚,推理长度就能减少 12%–23%。
- 准确率通常保持不变,甚至还能提升。
- 在部分设置下,过度思考错误可减少最多 58%。
论文把这视为一种对压缩模型很实用的解码修复方案:在节省内存和成本的同时,减少不必要的“想太多”。
「研究」频道最新
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11
- Jeff Heaton《神经网络数学导论》开放免费完整下载 — blaizedsouza · 2026-09-11
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- 本周热议的数学猜想到底关我什么事?一张普通人视角清单 — koltregaskes · 2026-09-11