研究:仅用小学课程预训练能教LLM学会技能吗

sdroege_ · reddit · 2026-08-16

LittleLearner 研究探究了现代大模型在“习得技能”与“激发已有知识”之间的界限。研究构建了一个 880 亿 token 的语料库,仅包含美国小学课程内容,并据此从头训练模型。

实验发现,虽然缩放定律、SFT+GRPO 后训练以及上下文学习都能放大课程教授的内容,但都无法显著提升模型在课程范围外的表现。这表明预训练数据的过滤实际上设定了模型能力的有效天花板。

所属事件:研究仅用小学课程训练5B模型探LLM知识边界(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →