医疗检索测评:微调 Late Interaction 拿下 91.4 分

tomaarsen · x · 2026-08-26

作者在 1000 个保留医疗问题和 20 万段文档上评估了 47 种模型配置(含 dense、sparse、lexical、multi-vector)。

结果显示,微调后的 Late Interaction 模型达到 91.4 NDCG@10,领先最佳零样本模型 6.2 分。在 Rank-1 准确率上,微调模型达到 84.9%,将剩余错误减少了三分之一,颜色图表也直观展示了 multi-vector 架构的统治力。

所属事件:单卡3090微调ColBERT医疗检索模型,多向量方法击败通用基座(13 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →