论文称冻结 12B 模型可零 token 重跑已验证程序

MindPsychological140 · reddit · 2026-07-28

一篇题为 Dynamic Re-Execution of Verified Solution Programs in Small LLMs 的论文提出,把“推理”和“执行”解耦。

作者的核心思路是:当数学、代码或形式规则等逻辑/领域知识被验证并纳入系统后,一个冻结的 12B 模型可以在新输入上重新执行这套逐步程序,做到零 token 开销、结果逐位一致且可重复。帖子附上了 arXiv 链接,强调这是一个面向高效推理的程序复用思路。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →