NaceAI 提出超网络知识注入法,无需修改大模型权重

NaceAI 发布了一篇关于超网络的新论文,探讨如何在不修改大模型核心参数的情况下注入事实知识。该方法通过另一个超网络将自然语言事实转化为 LoRA 权重并注入冻结的目标模型。研究证实,这种基于超网络的知识注入方法在大规模场景下呈现出明显的幂律缩放规律。

2026-07-23 ~ 2026-07-25 · 4 条相关