pplx-embed-v2 检索评测:9B 模型 BrowseComp-Plus 准确率 64.0% 领先
antoine_chaffin · x · 2026-10-08
Perplexity 团队继续公布 pplx-embed-v2 的 agentic retrieval 评测结果。
- 在 BrowseComp-Plus(纯文本)与 MADQA(多模态)上评测
- 文本任务上 9B 模型准确率 64.0%,领先所有 ColBERT 与稠密检索模型,且发出的搜索次数少于除自家 0.6B 外的任何模型
- 0.6B 模型也领先家族之外的其它模型
作者强调多向量模型的核心优势之一正是 agentic retrieval。
所属事件:Perplexity 开源多模态嵌入模型 pplx-embed-v2-late(38 条相关)→
「模型」频道最新
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08
- 三周冒出 113 个决策模型:七成基于 Qwen,最便宜的不到一厘钱 — jonathanmalkin · 2026-10-08
- 用户实测称 Haiku 5.5 是工作流重大升级 — Sorcerer12345 · 2026-10-08
- OpenRouter 上线决策模型排行榜,typesafeai 包揽全部类目第一 — gaganghotra_ · 2026-10-08
- OpenAI 推出 Intelligent UI,ChatGPT 可快速生成可交互界面作答 — gdb · 2026-10-08
- Claude Haiku 5.5 全线碾压 GPT-6 Luna,长上下文却贵 5 倍 — daniel_mac8 · 2026-10-08