Perplexity 开源 pplx-embed-v2 检索模型:免 OCR 直接索引 PDF 与图片
lmoroney · x · 2026-10-08
Perplexity 在 Hugging Face 以 MIT 许可发布检索模型 pplx-embed-v2-late,有 0.6B 和 9B 两个规格,基于 Qwen3.5 构建,由内部 18B 教师模型蒸馏而来。
- 采用 ColBERT 风格 late-interaction:每个 token 生成 128 维向量,查询按 MaxSim 逐 token 匹配打分
- 可直接处理文本、图片及 PDF、幻灯片等渲染页面,无需先跑 OCR
- 两个规格共享同一嵌入空间,小模型可查询 9B 建的索引
- 公开 ViDoRe v3 基准图像赛道:0.6B 达 nDCG@10 62.3%,9B 达 65.2%
作者提醒:逐 token 存向量会让索引体积很大,建议先用自己的几百份文档实测。
所属事件:Perplexity 开源 pplx-embed-v2-late 免 OCR 晚期交互嵌入模型(41 条相关)→
「模型」频道最新
- GLM 5.3 Flash 接 USB 搞硬件逆向:本地跑 55 tok/s、1M 上下文 — glenbeer · 2026-10-08
- 乘法零加速,只把评测榜单刷爆:AI 圈调侃刷榜乱象 — ChrisGPT · 2026-10-08
- 圈内共识:AI 模型目前还不擅长生物领域 — nlarusstone · 2026-10-08
- 双卡 192GB 玩家跑通 456GB 版 DeepSeek v4.1,SSD 分担专家权重 — HankYeomans · 2026-10-08
- 仅 15.4% 训练 token,Cascade 时序模型 58 天超越 Toto 2.0 — const_reborn · 2026-10-08
- LiquidAI 端侧多模态模型 LFM2-VL 3B 冲上 Hugging Face 热榜 — LiquidAI · 2026-10-08