pplx-embed 9B 助 agent 准确率提至 64%,超次优 4.9 分
tomaarsen · x · 2026-10-08
Perplexity 报告检索提升可传导至 agent 答案:在 BrowseComp+ 上,GPT-OSS-120B agent 配合 9B 检索器达到 64.0% 准确率,比次优的 ColBERT 模型高 4.9 分,且搜索次数更少。同一线程还给出 72 个文本检索任务上 9B 达 81.3 nDCG@10、0.6B 达 78.0(六组均分平均),训练时排除了相关基准数据集,评测相对公平。
所属事件:Perplexity 开源 pplx-embed-v2-late 晚期交互多模态嵌入模型(38 条相关)→
「模型」频道最新
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08
- 三周冒出 113 个决策模型:七成基于 Qwen,最便宜的不到一厘钱 — jonathanmalkin · 2026-10-08
- 用户实测称 Haiku 5.5 是工作流重大升级 — Sorcerer12345 · 2026-10-08
- OpenRouter 上线决策模型排行榜,typesafeai 包揽全部类目第一 — gaganghotra_ · 2026-10-08
- OpenAI 推出 Intelligent UI,ChatGPT 可快速生成可交互界面作答 — gdb · 2026-10-08
- Claude Haiku 5.5 全线碾压 GPT-6 Luna,长上下文却贵 5 倍 — daniel_mac8 · 2026-10-08