持续学习组合配方:100 个任务后知识保留率从 1.2% 提至 34.9%

mdredze · x · 2026-09-09

论文《Continual Learning Mechanisms Compose for Long-Horizon Memorization》研究长程记忆问题:在顺序微调下学习上百个任务,现有机制会导致灾难性遗忘,100 个任务后约损失 98.8% 的知识。

作者的做法是将四种现有持续学习机制组合:生成式回放、自蒸馏、权重正则化与合并 LoRA,分别保留不同形式的先验信息。结果显示最终保留率提升至 34.9%,其中 replay + merged LoRA 呈现超加性的协同收益。

结论简单但有力:组合现有机制本身就是一个非常强且简单的配方,为长任务序列下的知识保留提供了实用路径。

所属事件:JHU 研究:组合持续学习机制,百任务记忆保留率大幅提升(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →