检索专家质疑:域外稠密模型跑不过 BM25 不算数
srchvrs · x · 2026-08-26
检索领域研究者 srchvrs 追问:同数据集上训练的稠密检索器在哪里?他指出对方所用模型看起来是域外的,因此跑不过 BM25 并不能说明问题。背景是他刚发布博客,用 Sentence Transformers 微调 ColBERT 风格多向量模型做医学检索,单张 RTX 3090 训练 14.5 小时即超过所有能找到的通用检索器。这场对话与 tomaarsen 的回应共同指向一个方法论问题:基准数据集的查询构造方式(是否从文档生成)会系统性偏向 BM25。
所属事件:单卡3090微调ColBERT医疗检索模型,多向量方法击败通用基座(13 条相关)→
「研究」频道最新
- 陶哲轩:自动形式化尚昂贵耗时,但正在快速改善 — littmath · 2026-08-27
- 陶哲轩以身作则:用AI审查自己全部已发表论文找错 — littmath · 2026-08-27
- 陶哲轩:用AI产出更好的工作,而非更多PDF — littmath · 2026-08-27
- 中国前沿模型齐用线性注意力,Zai 推 MIT 开源 320B 多模态模型 — ivan_bezdomny · 2026-08-26
- 基于贝叶斯推断的 CI 故障诊断 Agent 设计与实现 — Elegant_Quantity_583 · 2026-08-26
- Nature 论文:规模化实验表征加速蛋白质设计 — DaveJuergens · 2026-08-26