新论文用推理时合并上千 LoRA 扩展局部 MoE

s_scardapane · x · 2026-07-29

通过模型合并做“几乎免费的”测试时训练

这篇论文提出 Test-Time Model Merging(TTMM):先在很多很小的数据簇上训练成千上万个 LoRA,再在推理时按需动态合并,把 MoE 扩展到比传统做法多得多的专家数量,同时几乎不增加测试时开销。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →