Perplexity 发布 pplx-embed-v2-late:小模型查询大模型文档向量
tomaarsen · x · 2026-10-08
Perplexity 发布 pplx-embed-v2-late 双模型(0.6B 与 9B),用于文本与图像检索。关键发现:0.6B 查询模型 + 9B 文档模型的组合比双侧 0.6B 都要更强——文本六域平均 nDCG@10 从 78.0 提升到 79.6,ViDoRe v3 图像从 62.3 提升到 63.5。
两个尺寸共享同一嵌入空间:可以先用 9B 对语料库编码,再用 0.6B 低延迟地服务查询。两者均从同一个 18B 教师模型蒸馏而来,通过对齐逐 token 嵌入实现跨模型检索,即小模型可以直接搜索大模型生成的文档向量。
所属事件:Perplexity 开源多模态嵌入模型 pplx-embed-v2-late(38 条相关)→
「模型」频道最新
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08
- 三周冒出 113 个决策模型:七成基于 Qwen,最便宜的不到一厘钱 — jonathanmalkin · 2026-10-08
- 用户实测称 Haiku 5.5 是工作流重大升级 — Sorcerer12345 · 2026-10-08
- OpenRouter 上线决策模型排行榜,typesafeai 包揽全部类目第一 — gaganghotra_ · 2026-10-08
- OpenAI 推出 Intelligent UI,ChatGPT 可快速生成可交互界面作答 — gdb · 2026-10-08
- Claude Haiku 5.5 全线碾压 GPT-6 Luna,长上下文却贵 5 倍 — daniel_mac8 · 2026-10-08