LLM 持续学习方法 iSDFT 开源:500+ 实验平衡可塑性与稳定性

hbouammar · x · 2026-09-23

研究者发布 Info-SDFT(iSDFT):一种面向信息约简的在策略自蒸馏方法,用于 LLM 的有效持续学习。核心思路:

团队做了超过 500 组实验验证,已开源训练代码、Tool Use 与 Science 数据集、评测器及训练好的 checkpoints。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →