只训练投影器即可扩展新模态,Llama 能力不退化
rohanpaul_ai · x · 2026-08-25
论文《Projector Is All You Train》提出,通过仅训练编码器与骨干模型之间的投影器,即可向语言模型添加新模态(如 3D),而无需微调模型权重。实验表明,冻结骨干的模型在训练速度上快两倍,且在 3D 任务中表现优于联合微调模型;反之,联合微调会导致 Llama 在 GSM8K 上的准确率从 86.96% 崩塌至 0.61%。
「模型」频道最新
- Grok Voice 夺冠,力压所有 GPT 实时模型 — XFreeze · 2026-08-25
- 网友实测:Minimax H3 用中文提问效果大幅提升,英文提示词或拖后腿 — apoke890 · 2026-08-25
- 疑似 Gemini 3.8 Flash 提前泄露,网友称谷歌兑现小模型更新承诺 — Last_Conclusion_8984 · 2026-08-25
- 只改一个词结果大不同,用户实测 AI 回答存性别偏差 — RecordingThis6802 · 2026-08-25
- Fal 推出微调版 H3 模型,推理栈优化实现极速 — isidentical · 2026-08-25
- 实时语音 AI 听得到情绪却不用:120 次测试 119 次照本宣科 — Once_ina_Lifetime · 2026-08-25