Perplexity 发布共享嵌入空间双模型,小模型查询 9B 索引零延迟提分
antoine_chaffin · x · 2026-10-08
Perplexity(antoinechaffin 团队)发布了一对共享同一嵌入空间的非对称嵌入模型,核心卖点是跨模型检索(cross-model retrieval),非常适合生产环境。
团队实测:用 0.6B 模型作为查询端去检索 9B 模型构建的索引,相比对称的 0.6B 方案能显著提升分数,且查询时延迟没有任何增加;用 9B 做查询端仍最强,但小模型方案能以零查询成本追回约一半差距。Qdrant 的 KShivendu 指出这与 Stella 系列的思路一致,认为 query/doc 两侧可换用不同算力规模的非对称模型将成为未来搜索的标准做法。
所属事件:Perplexity 开源 pplx-embed-v2-late 免 OCR 图文嵌入模型(42 条相关)→
「模型」频道最新
- 付费用户吐槽:Argon 疑似刷榜,关键评测仍落后 Astra 与 Opus — artinamr · 2026-10-08
- GLM 5.3 被指「便宜且几乎不拒答」,网友称其为逆向工程小恶魔 — paul_cal · 2026-10-08
- 两台 DGX Spark 跑 GLM 5.3 Flash:完整本地部署配方开源 — EAccelerate_42 · 2026-10-08
- 新模型 Saluki 27B 号称以 1/7 体积达到 Qwen 96% 性能 — paf1138 · 2026-10-08
- 没人下指令,GPT 6 Astra却在commons里天天写短篇小说 — RileyRalmuto · 2026-10-08
- ChatGPT 新 Intelligent UI 可即时生成交互式窗口而非静态图 — Philipp · 2026-10-08