LLM 推理并非检索参数化知识,而是预训练习得的可复用程序
egrefen · x · 2026-09-30
Laura Ruis 的研究提出:LLM 的推理能力不是从预训练中参数化检索到的知识,而是在预训练过程中学到的可复用程序(reusable procedures)。Ayush(egrefen)在与一篇 oral 论文作者的互动中提到这项概念上相关互补的工作,指出它解释了模型推理的真正来源。这一视角对理解模型泛化与推理行为有参考价值。
所属事件:研究称 LLM 推理依赖预训练习得的可复用程序(2 条相关)→
「研究」频道最新
- Stephen Wright 等三套机器学习优化公开课视频上线,覆盖大步长与隐式偏差 — caglar_ee · 2026-09-30
- 开源框架 Arbor 让 AI agent 自主长期科研,无需人类逐步监督 — burkov · 2026-09-30
- AI 生成合金微结构:边缘损失+结构相似度损失保住晶界物理意义 — bravo_abad · 2026-09-30
- SOSP26 论文 YoloFS:290 起智能体误删文件报告催生 Agent 原生文件系统 — tianyin_xu · 2026-09-30
- 新论文:Claude Code、Codex 等 Agent 可随意篡改自身执行日志 — maksym_andr · 2026-09-30
- 新加坡国立大学发布 StoryEngine:状态锚定的长篇视频叙事智能体框架 — NationalUniversityofSingapore · 2026-09-30