论文称冻结 12B 模型可零 token 重跑已验证程序
MindPsychological140 · reddit · 2026-07-28
一篇题为 Dynamic Re-Execution of Verified Solution Programs in Small LLMs 的论文提出,把“推理”和“执行”解耦。
作者的核心思路是:当数学、代码或形式规则等逻辑/领域知识被验证并纳入系统后,一个冻结的 12B 模型可以在新输入上重新执行这套逐步程序,做到零 token 开销、结果逐位一致且可重复。帖子附上了 arXiv 链接,强调这是一个面向高效推理的程序复用思路。
「研究」频道最新
- Simons Institute 讨论科研自动化下的研究者应对 — ceciletamura · 2026-07-28
- 研究型 Agent 能停下来,比强行给答案更可靠 — Harshit-24 · 2026-07-28
- Reddit 讨论用第二个 AI 识别并删除文本废话 — pete_dom · 2026-07-28
- “模型吃掉 harness” 本质是部署驱动的持续进化 — m_wulfmeier · 2026-07-28
- 一张图讲清 PCA:中心化、特征向量与方差保留 — mdancho84 · 2026-07-28
- 为什么世界模型被视作 AI 的下一步关键方向 — JackFisherBooks · 2026-07-28