统一框架:数据归因、灾难性遗忘与可塑性丧失同源于 token 交互

Yi Ren · hf · 2026-10-01

现代语言模型会终身持续更新而非一次训练即冻结,每一步更新都参与循环:决定学什么、理解更新改变了什么、并保持未来可学习性。论文提出这三者受同一"更新-行为交互"支配:

结论在多个模型与训练 regime 下成立。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →