小模型查大模型索引:不增延迟即可缩小一半性能差距

antoine_chaffin · x · 2026-10-08

两个模型共享同一 embedding 空间让跨模型检索成为可能。作者实测用 0.6B 模型查询 9B 模型建的索引,与对称的 9B/0.6B 组合对比:用小模型查询 9B 索引,相比 0.6B 索引得分提升且不增加查询时延迟;用 9B 查询仍然最强,但 0.6B 查询就能闭合约一半差距。

所属事件:Perplexity 开源多模态嵌入模型 pplx-embed-v2-late(38 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →