研究:LLM 推理靠预训练学到的程序性知识而非死记答案

egrefen · x · 2026-09-30

Laura Ruis 等人的论文《Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models》研究了 LLM 在推理任务上依赖哪些预训练数据。团队对 7B 和 35B 两个模型、各 2.5B 预训练 token 做影响分析,覆盖三个简单数学推理任务,并与事实问答的数据依赖对比。

该论文 oral 中选,作者在推文中向相关研究者推荐,认为与 Ruis 团队的工作概念上互补。

所属事件:研究称 LLM 推理依赖预训练习得的可复用程序(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →