Meta 发现:量化推理模型常在答对后又开始怀疑

rohanpaul_ai · x · 2026-07-22

Meta 这篇论文指出,量化后的推理模型失败,很多时候不是因为想不出答案,而是因为已经想对了却又开始怀疑自己。作者认为,后训练量化会在生成过程中放大某些犹豫词的出现概率,比如 “wait”“but”“alternatively”,从而让模型在答案已经接近完成时重新打开问题。

论文在 5 个推理模型、多种量化方法、以及 1.5B 到 32B 的模型规模上,覆盖数学、代码和科学任务进行实验。主要结论是:

论文把这视为一种对压缩模型很实用的解码修复方案:在节省内存和成本的同时,减少不必要的“想太多”。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →