SaveRouter论文:LLM路由只用四成监督数据即可回本

SinapisAI · hf · 2026-09-30

发表于 Hugging Face 的论文 SaveRouter 研究 LLM 路由的成本经济学问题:训练路由器通常需要先在历史查询上跑多个候选模型来收集质量反馈,这笔前置监督成本常被忽视,且路由质量往往在收集完全部反馈之前就已饱和。

SaveRouter 采用稀疏监督框架:选择性获取有信息量的模型反馈,并在相关查询间共享能力信息,同时保留查询级细化。在四个路由基准上:

代码已开源(LAMDA-Model-Reuse/SaveRouter)。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →