长文本优势减弱?BM25 在合成查询检索中反超 LLM
tomaarsen · x · 2026-08-26
在 MIRIAD 数据集上的评测显示,部分 LLM 的表现未能超越传统的 BM25 算法。主要原因在于该数据集的查询直接基于文档生成,这对关键词匹配方法(BM25)极为有利。此外,该数据集的平均序列长度约为 984 tokens,这对支持长上下文的模型或对上下文长度不敏感的模型(如 BM25)更为有利。
所属事件:MIRIAD 检索评测引热议,BM25 反超部分 LLM 检索器(3 条相关)→
「研究」频道最新
- PrimeIntellect verifiers v0.3.1:支持模型拦截与持久会话 — xeophon · 2026-08-27
- RAG 未死:探讨检索增强与智能体搜索的边界 — hugobowne · 2026-08-27
- 当 AI 运营实验室:与 Ant Rowstron 的播客 — JMarty97 · 2026-08-27
- AI 审查非全能:Refine 漏掉了一个已知的引理错误 — littmath · 2026-08-27
- 数学家 Litt 自述:论文错误多源于改稿时未同步传播编辑 — littmath · 2026-08-27
- 陶哲轩以身作则:用AI审查自己全部已发表论文找错 — littmath · 2026-08-27