pplx-embed-v2-late 基于 Qwen3.5,逐 token 保留 128 维向量

tomaarsen · x · 2026-10-08

pplx-embed-v2-late 技术细节:模型基于 Qwen3.5 并使用双向注意力,每个 token 保留一个 128 维向量。检索采用 MaxSim 晚交互机制——查询中每个 token 取其在文档中的最佳匹配分数,再求和,因此查询的不同部分可以匹配页面的不同部分。

模型已在 Sentence Transformers 中原生支持,可通过 model.similarity() 直接计算相似度。

所属事件:Perplexity 开源多模态嵌入模型 pplx-embed-v2-late(38 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →