0.6B 视觉检索模型媲美 8B 级对手,文档检索不牺牲图像搜索
antoine_chaffin · x · 2026-10-08
作者介绍其视觉嵌入模型的检索评测结果:在 ViDoRe(视觉文档检索)上,他们的 0.6B 模型可与更大模型竞争,在 MIRACL-Vision 上接近 Qwen3-VL-Embed-8B;9B 模型超过除 Gemini-Embedding-2 外的所有对比模型。\n\n在内部基准 PPLX-Q2I(覆盖生产日志中的视觉文档与自然图像)上,两个模型都大幅领先 Qwen3-VL-Embedding-8B,9B 紧随 Gemini-Embedding-2。作者强调:虽然模型主要用于文档检索,但在自然图像语料上同样保持竞争力,说明强文档检索能力并未以牺牲自然图像搜索为代价。
所属事件:Perplexity 开源 pplx-embed-v2-late 双模型,免 OCR 图文检索(36 条相关)→
「模型」频道最新
- Reza Zadeh 发帖数小时后,OpenAI 即公布 2.25 的数学新纪录 — Reza_Zadeh · 2026-10-08
- AI2 Bolmo 分词器消除全球南方文字的「token 税」 — Kyle_L_Wiggers · 2026-10-08
- Grok 机器人上线主动式功能,可主动建议你下一步做什么 — Daniel_Farinax · 2026-10-08
- OpenAI 与 Cloudflare 推出决策 API,355 道决策实测不敌 TypeSafe 的 Jev — PawelHuryn · 2026-10-08
- Gary Marcus 炮轰 OpenAI 数学突破报告:换未发布模型、零细节,过不了同行评审 — Gary Marcus · 2026-10-08
- d1-3B 小到能跑 MacBook,实测给穿搭打分 — JosephJacks_ · 2026-10-08