COLM 2026 论文提出「无权重微调」,为百万用户个性化 LLM 免去 SFT
TuhinChakr · x · 2026-10-09
哥伦比亚团队在 COLM 2026 展示海报论文《Weightless Fine-tuning for Personalizing LLMs without actual Fine-tuning》,针对 SFT 个性化模型的核心痛点:要给每个用户单独跑优化、存一份 LoRA 权重、还要随新数据重训,规模化到百万用户时成本爆炸。
论文思路是不做实际权重更新就实现个性化(细节在海报中)。作者此前与 Tuhin Chakraborty、Jane Ginsburg 合作,用按作者 SFT 复现获奖作家的写作风格,验证过 SFT 是个性化最强手段之一,本工作正是为解决其扩展性问题。
「研究」频道最新
- n=12 立方体堆积纪录刷新至 2.9315,AI 方法击败前纪录 — CatAstro_Piyush · 2026-10-09
- 研究:用 LLM 当裁判评「想法新颖度」并不可靠 — MarioKrenn6240 · 2026-10-09
- 腾讯开源 STEPQuant:6-bit 递归状态省 68.7% 推理内存不失精度 — _akhaliq · 2026-10-09
- 斯坦福 LoT Diffusion:按细节分配 token,图像视频生成显著提速 — GordonWetzstein · 2026-10-09
- Datapoint 推出 Streams:1B+ 真人实时评分,给多模态模型做在线 RL — _akhaliq · 2026-10-09
- 提出 Agent Plasticity:衡量智能体从经验学习的效率,最强者未必最会学 — RulinShao · 2026-10-09