Perplexity 发布 pplx-embed-v2-late:小模型查询大模型文档向量

tomaarsen · x · 2026-10-08

Perplexity 发布 pplx-embed-v2-late 双模型(0.6B 与 9B),用于文本与图像检索。关键发现:0.6B 查询模型 + 9B 文档模型的组合比双侧 0.6B 都要更强——文本六域平均 nDCG@10 从 78.0 提升到 79.6,ViDoRe v3 图像从 62.3 提升到 63.5。

两个尺寸共享同一嵌入空间:可以先用 9B 对语料库编码,再用 0.6B 低延迟地服务查询。两者均从同一个 18B 教师模型蒸馏而来,通过对齐逐 token 嵌入实现跨模型检索,即小模型可以直接搜索大模型生成的文档向量。

所属事件:Perplexity 开源多模态嵌入模型 pplx-embed-v2-late(38 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →