Perplexity 发布共享嵌入空间双模型,小模型查询 9B 索引零延迟提分

antoine_chaffin · x · 2026-10-08

Perplexity(antoinechaffin 团队)发布了一对共享同一嵌入空间的非对称嵌入模型,核心卖点是跨模型检索(cross-model retrieval),非常适合生产环境。

团队实测:用 0.6B 模型作为查询端去检索 9B 模型构建的索引,相比对称的 0.6B 方案能显著提升分数,且查询时延迟没有任何增加;用 9B 做查询端仍最强,但小模型方案能以零查询成本追回约一半差距。Qdrant 的 KShivendu 指出这与 Stella 系列的思路一致,认为 query/doc 两侧可换用不同算力规模的非对称模型将成为未来搜索的标准做法。

所属事件:Perplexity 开源 pplx-embed-v2-late 免 OCR 图文嵌入模型(42 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →