医疗检索测评:微调 Late Interaction 拿下 91.4 分
tomaarsen · x · 2026-08-26
作者在 1000 个保留医疗问题和 20 万段文档上评估了 47 种模型配置(含 dense、sparse、lexical、multi-vector)。
结果显示,微调后的 Late Interaction 模型达到 91.4 NDCG@10,领先最佳零样本模型 6.2 分。在 Rank-1 准确率上,微调模型达到 84.9%,将剩余错误减少了三分之一,颜色图表也直观展示了 multi-vector 架构的统治力。
所属事件:单卡3090微调ColBERT医疗检索模型,多向量方法击败通用基座(13 条相关)→
「研究」频道最新
- 陶哲轩:自动形式化尚昂贵耗时,但正在快速改善 — littmath · 2026-08-27
- 陶哲轩以身作则:用AI审查自己全部已发表论文找错 — littmath · 2026-08-27
- 陶哲轩:用AI产出更好的工作,而非更多PDF — littmath · 2026-08-27
- 中国前沿模型齐用线性注意力,Zai 推 MIT 开源 320B 多模态模型 — ivan_bezdomny · 2026-08-26
- Nature 论文:规模化实验表征加速蛋白质设计 — DaveJuergens · 2026-08-26
- 安全研究员用 GPT-5.6 攻破密码算法 MERIDIAN — evilsocket · 2026-08-26