EVIE 论文:多模态裁判+嵌套嵌入,单模型支撑6种维度的视觉文档检索
_reachsumit · x · 2026-10-09
腾讯团队提出 EVIE,一族原生视觉文档检索器,三大创新:
- 证据裁判数据治理:用多模态裁判模型标注含答案的正样本页、过滤不可靠负样本。
- 双向师生学习:对称 listwise 蒸馏 + 基于前缀的 Matryoshka 表示学习(Prefix-MRL),一个 checkpoint 即可输出六种嵌套嵌入维度,无需重新编码。
- 层级凝聚索引压缩(HAC):带空间正则的 token 聚类,存储语义质心以缩小索引。
针对视觉文档检索(VDR)中 OCR 流程慢且丢失视觉结构、单向量粒度不足、多向量索引过大等痛点,兼顾细粒度理解与索引效率。
「研究」频道最新
- 给 AI 智能体一个空 3D 世界:它们自建村庄甚至撰写宪法 — pkmital · 2026-10-09
- 40G 显存训练 Qwen3.8-Flash-Next:LoRA over GGUF 无需 CPU offload — woct0rdho · 2026-10-09
- 贝叶斯更新救不了错误模型:Gelman 论文戳破 AI 圈概率化思维盲区 — sebkrier · 2026-10-09
- 审计 162 个大模型跑分差距:仅 20 个能真正区分高下 — maverick_man1111 · 2026-10-09
- 快手团队 LIFT:交互拆成四类token,检索排序共享一个历史编码器 — _reachsumit · 2026-10-09
- IBM 推出 RIT-RAG:用检索结果反推文档子树,agent 自主选读章节 — _reachsumit · 2026-10-09