研究称 LLM 推理依赖预训练习得的可复用程序
Laura Ruis 等人的研究《Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models》提出,大语言模型的推理能力并非通过参数化方式检索预训练中记忆的具体知识或答案,而是源于预训练过程中学到的可复用程序性知识(reusable procedures)。这一发现为理解 LLM 推理机制提供了新视角,引发了社区关注与讨论。
2026-09-30 ~ 2026-09-30 · 2 条相关
- LLM 推理并非检索参数化知识,而是预训练习得的可复用程序 — egrefen · 2026-09-30
- 研究:LLM 推理靠预训练学到的程序性知识而非死记答案 — egrefen · 2026-09-30