9B 索引配 0.6B 查询:pplx-embed-v2 同嵌入空间实现跨模型检索
antoine_chaffin · x · 2026-10-08
pplx-embed-v2 系列的关键特性之一:9B 与 0.6B 模型共享同一嵌入空间,支持跨模型检索。
Perplexity 团队实测了「用 0.6B 模型查询 9B 索引」的方案,并与对称的 9B-9B、0.6B-0.6B 组合对比。结果显示,小模型查询 9B 索引的得分优于使用 0.6B 索引——为生产环境提供了低查询成本、高索引质量的非对称部署选择。
所属事件:Perplexity 开源 pplx-embed-v2-late 双模型,免 OCR 图文检索(36 条相关)→
「Infra」频道最新
- Windows 现场 demo:编码任务被自动路由到本地模型,llama.cpp 已接入 Windows ML — ryanshrout · 2026-10-08
- exe.dev 详解超线程侧信道风险:用 core scheduling cookie 做团队级隔离 — davidcrawshaw · 2026-10-08
- NVIDIA 发布 LoGRA:强化学习训练显存最高省 45.7% — mark_k · 2026-10-08
- 6 卡 3090 无 NVLink 跑 Qwen3.8-Flash-Next:prefill 快 8-10 倍,长文解码快 2-3 倍 — flynth92 · 2026-10-08
- DeepMind Philipp Schmid:每个 Agent 都该有自己的云端沙盒 — AI Engineer · 2026-10-08
- GitHub 全球宕机,工程师吐槽「正在抢修」 — iannuttall · 2026-10-08