只训练投影器即可扩展新模态,Llama 能力不退化

rohanpaul_ai · x · 2026-08-25

论文《Projector Is All You Train》提出,通过仅训练编码器与骨干模型之间的投影器,即可向语言模型添加新模态(如 3D),而无需微调模型权重。实验表明,冻结骨干的模型在训练速度上快两倍,且在 3D 任务中表现优于联合微调模型;反之,联合微调会导致 Llama 在 GSM8K 上的准确率从 86.96% 崩塌至 0.61%。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →