CrossQ:ColBERT 风格检索的跨 Token 条件量化
_reachsumit · x · 2026-08-21
论文提出了 CrossQ,一种针对 ColBERT 风格晚期交互检索的压缩方法。标准量化最小化 Token 重构误差,而 CrossQ 在索引时根据轻量级文档上下文条件化 Token 代码,并使用排序对齐目标进行训练。在 2 bits/token 下,CrossQ 相比最强基线将 MRR@10 提升了 +0.010;在 4 bits/token 下,实现了 64 倍的原始 Token 存储缩减,并保留了约 98% 的全精度性能。
「研究」频道最新
- ShikharMurty:Pass@k 上升不代表模型学到新东西 — ShikharMurty · 2026-08-21
- 生信工具 FasterFASTA:多线程解压提速明显 — viglovikov · 2026-08-21
- 普林斯顿论文:法律搜索基准不适用现实,发布新数据集 — burkov · 2026-08-21
- MIT 论文证伪:从训练集中删除图像不影响模型生成 — technollama · 2026-08-21
- 新期刊将沿用 GEB 编委会,传统出版商价值受疑 — Afinetheorem · 2026-08-21
- 开源 HarnessEval-W:世界模型的 Agentic 评测新范式 — 青稞AI · 2026-08-21