LLM 推理并非检索参数化知识,而是预训练习得的可复用程序

egrefen · x · 2026-09-30

Laura Ruis 的研究提出:LLM 的推理能力不是从预训练中参数化检索到的知识,而是在预训练过程中学到的可复用程序(reusable procedures)。Ayush(egrefen)在与一篇 oral 论文作者的互动中提到这项概念上相关互补的工作,指出它解释了模型推理的真正来源。这一视角对理解模型泛化与推理行为有参考价值。

所属事件:研究称 LLM 推理依赖预训练习得的可复用程序(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →