研究揭示 LLM 预训练获取事实知识:记忆延迟30步、重复数据加速遗忘

gordic_aleksa · x · 2026-09-10

arXiv 论文《How Do Large Language Models Acquire Factual Knowledge During Pretraining?》(Hoyeon Chang、Minjoon Seo 等)系统研究了 LLM 预训练中事实知识的获取机制。

这些观察可以解释近期 LLM 的一些行为(如知识更新后性能不佳等),对预训练数据配比与知识注入实践有直接参考价值。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →