谷歌 5390 万参数扩散模型让查询扩展提速 12-20 倍

imjustnewatai · x · 2026-09-16

Google 团队(9 月 15 日文章)提出 retrieve-for-train 模式:用强化学习训练一个语言模型来生成训练样本,再教一个仅 5390 万参数的小型扩散模型并行产出多个检索扩展方向,将搜索查询扩展阶段提速 12-20 倍。

作者总结的可复用思路:把昂贵的推理放在训练期,部署一个小型专用模型来干重复性任务——这是用小模型换推理成本的有效模式。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →