Perplexity 开源图文检索嵌入模型,登顶多项基准
Perplexity 于 10 月 8 日发布并开源 pplx-embed-v2-late:一个 9B 与一个 0.6B 的晚期交互多向量嵌入模型,基于 Qwen3.5 双向注意力,逐 token 保留 128 维向量,检索采用 MaxSim 晚交互机制。两模型可统一检索文本、图像与整页内容,PDF、幻灯片、截图、图表等文档页面可直接当作图像检索,无需 OCR,已上线 Hugging Face(据 @antoinechaffin 为 MIT 协议),并原生支持 Sentence Transformers(需 sentence-transformers>=6.0.0),pip 安装即可使用。
已确认
- 9B 与 0.6B 共享同一嵌入空间:可用 9B 离线编码整个语料库,再用 0.6B 在线服务查询。两模型均由同一个 18B 教师模型通过对齐逐 token 嵌入蒸馏而来。
- 多模态成绩:ViDoRe v3 图像模式下 9B 平均 65.2%(nDCG@10),超过 nemotron-colembed-v2-8b,仅落后视觉专精的 EVIE,且嵌入维度小得多;0.6B 得 62.3%,与 8B 的 Nemotron ColEmbed V2 仅差 1.2 分。据 @antoinechaffin,9B 在 MIRACL-Vision 上超过除 Gemini-Emb(视觉专精)外的对手,0.6B 接近 Qwen3-VL-Embed-8B。
- Agentic 检索:BrowseComp+ 上 GPT-OSS-120B agent 配合 9B 检索器达 64.0% 准确率,比次优 ColBERT 模型高 4.9 分,且搜索次数更少;另在 MADQA 多模态任务上评测。
- 跨模型检索实测:0.6B 查询 + 9B 文档索引的组合优于双侧 0.6B,可闭合约一半与 9B-9B 组合的差距且查询延迟不变,为生产提供精度-延迟权衡方案。
- 0.6B 细节(@tomaarsen):以 Qwen3.5-0.8B 为起点,文本塔从 24 层剪枝到 12 层,总参数 594M,其中文本编码约 240M 激活、图像约 340M。
为什么重要
共享嵌入空间的非对称检索范式让低成本设备端查询与大模型离线索引结合成为可能;免 OCR 的页面级视觉检索显著降低文档处理管线复杂度,且检索质量提升可传导至下游 agent 答案准确率。
2026-10-08 ~ 2026-10-08 · 36 条相关
一手来源
- Perplexity 发布 pplx-embed-v2-late:免 OCR 晚期交互嵌入模型霸榜 — perplexity_ai ·
- Perplexity 发布 pplx-embed-v2-late:小模型查询大模型文档向量 — tomaarsen ·
- 多模态检索成绩:9B 得 65.2% 胜 nemotron-colembed-v2-8b — antoine_chaffin ·
- 【源头】Perplexity 发布 pplx-embed-v2-late:免 OCR 晚期交互嵌入模型霸榜 — perplexity_ai · 2026-10-08
- Perplexity 发布 pplx-embed-v2 嵌入模型,PDF 问答检索榜登顶 92.4% — perplexity_ai · 2026-10-08
- 开源 9B ColBERT 系列检索模型发布,文本、多模态与 agentic 检索均达前沿水平 — antoine_chaffin · 2026-10-08
- Contextual AI 开源 9B/0.6B ColBERT 系多模态检索模型,文本与视觉检索均达前沿 — antoine_chaffin · 2026-10-08
- 为什么多模态检索要直接嵌入渲染页面?late interaction 作者详解设计动机 — antoine_chaffin · 2026-10-08
- 18B 教师蒸馏出共享向量空间的 9B/0.6B 学生,实现跨模型检索 — antoine_chaffin · 2026-10-08
- 非对称检索架构:9B 建索引、0.6B 编码查询,兼顾精度与线上延迟 — antoine_chaffin · 2026-10-08
- 小模型查大模型索引:不增延迟即可缩小一半性能差距 — antoine_chaffin · 2026-10-08
- 186M 查询-文档对、594 数据集、46 语言训练,评测集数据全部剔除 — antoine_chaffin · 2026-10-08
- Q2D-Web 榜单前二:0.6B 击败旧榜首 nemotron-embed-8b — antoine_chaffin · 2026-10-08
- 【源头】多模态检索成绩:9B 得 65.2% 胜 nemotron-colembed-v2-8b — antoine_chaffin · 2026-10-08
- 72 项 MTEB 式任务 9B 夺冠,0.6B 追平 gemini-embedding-2 — antoine_chaffin · 2026-10-08
- 0.6B 视觉检索模型媲美 8B 级对手,文档检索不牺牲图像搜索 — antoine_chaffin · 2026-10-08
- 跨模型检索实测:0.6B 查 9B 索引零成本缩小一半差距 — antoine_chaffin · 2026-10-08
- 9B 索引配 0.6B 查询:pplx-embed-v2 同嵌入空间实现跨模型检索 — antoine_chaffin · 2026-10-08
- pplx-embed-v2 检索评测:9B 模型 BrowseComp-Plus 准确率 64.0% 领先 — antoine_chaffin · 2026-10-08
- Perplexity 开源 pplx-embed-v2 嵌入模型,9B 版多模态检索准确率达 92.4% — antoine_chaffin · 2026-10-08
- 开源检索模型补充细节:非对称设计适配生产部署,多模态与文本检索双前沿 — antoine_chaffin · 2026-10-08
- Perplexity 开源 pplx-embed-v2-late:共享嵌入空间可跨模型检索图文 — CShorten30 · 2026-10-08
- Perplexity 发布 pplx-embed-v2-late:0.6B/9B 文图检索模型 — tomaarsen · 2026-10-08
- Perplexity 新嵌入模型:无需 OCR 直接检索 PDF 与截图 — tomaarsen · 2026-10-08
- pplx-embed-v2-late 基于 Qwen3.5,逐 token 保留 128 维向量 — tomaarsen · 2026-10-08
- 【源头】Perplexity 发布 pplx-embed-v2-late:小模型查询大模型文档向量 — tomaarsen · 2026-10-08
- 9B 与 0.6B 嵌入模型共享向量空间,可用大模型编码小模型检索 — tomaarsen · 2026-10-08
- 两尺寸共享向量空间:9B 编码文档、0.6B 服务查询 — tomaarsen · 2026-10-08
- 0.6B 版 ViDoRe v3 仅落后 8B 模型 1.2 分 — tomaarsen · 2026-10-08
- pplx-embed 9B 助 agent 准确率提至 64%,超次优 4.9 分 — tomaarsen · 2026-10-08
- 0.6B 模型基于 Qwen3.5-0.8B 剪枝:仅约 240M 文本激活参数 — tomaarsen · 2026-10-08
- Perplexity 嵌入模型 0.6B 小模型拿下 62.3 分 — antoine_chaffin · 2026-10-08
- Perplexity 开源 pplx-embed-v2 嵌入模型,MIT 协议已可安装 — tomaarsen · 2026-10-08
- Perplexity 开源视觉检索模型,一行 pip 接入 sentence-transformers — antoine_chaffin · 2026-10-08
- Perplexity 嵌入模型共享向量空间:0.6B 可白嫖 9B 索引 — antoine_chaffin · 2026-10-08
另有 4 条近重复转述:beirmug · CShorten30 · antoine_chaffin · antoine_chaffin