LLM 需要“睡眠”来巩固记忆

behrouz_ali · x · 2026-07-14

这篇工作提出:LLM 可能需要类似“睡眠”的阶段——在没有新数据输入时,模型先把脆弱的短期记忆巩固成更稳定的长期记忆,再通过“做梦”式过程递归自我改进。

作者提出了一种新的蒸馏形式 Knowledge Seeding(KS):让小模型把知识蒸馏给大模型。实验显示,这个阶段能改善持续学习与推理任务表现,并在一定程度上缓解灾难性遗忘。

所属事件:大模型持续学习新思路:引入睡眠做梦机制与场景重定义(13 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →