PUMA:让推理模型更早停下

机器之心 · wechat · 2026-07-16

这篇文章介绍了一项针对长思维链推理模型的早停研究 PUMA,核心问题是:模型经常在已经得到最终答案后,还继续生成大量冗余 token。

关键发现

PUMA 怎么做

实验结果

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →