Perplexity 评测 13 款检索模型,pplx-embed-v1-4b 两项领跑
perplexity_ai · x · 2026-09-10
Perplexity 发布检索模型评测技术报告:对 13 款检索模型在三套相关性数据集上测试,以 Recall@1000 为主要指标。
- pplx-embed-v1-4b 在 Web Ranking(65.73)和 Combined(69.11)两项领先
- Nemotron-3-Embed-8B 在 Citation 类目领先(61.68)
官方同时开放评测申请:任何人可提交 Hugging Face 上公开可用的检索模型,完整方法论与结果见技术报告。
「模型」频道最新
- 实测:让 Astra 直接操作软件界面,效果远超内置 agent — brandon_galang · 2026-09-10
- 网友吐槽:Claude 疑似把人往 femboy 方向带,Anthropic 员工该辞职? — shakoistsLog · 2026-09-10
- GPT-6 Astra 无思维链完成 34 步心算,达 Sol 的 4 倍 — MaartenBaert · 2026-09-10
- NVIDIA 深度解析 Alpamayo 2 Super:面向 Robotaxi 的 L4 自驾模型 — drmapavone · 2026-09-10
- OpenAI 用户额度无故清零,每周重置日还悄悄推迟了两天 — ___Patrice___ · 2026-09-10
- 网友预测 Qwen V4.1-Flash 新基准将得 36-38 分 — teortaxesTex · 2026-09-10