VultronRetriever检索模型家族发布

madkimchi · reddit · 2026-07-11

Hugging Face 上发布了 VultronRetriever 系列检索模型,强调可在 iPhone 上完全离线运行 Q&A 和文档 embedding。该系列在 MTEB 上取得了很强的成绩:Prime-8B 在各自类别中排名第一、并号称是全局第 1;Core-4.5B 排名第二;Flash-0.8B 也能在边缘设备上运行,并支持更高吞吐。\n\n作者还给出了一些工程卖点:\n- Prime-8B 的索引存储占用比上一代 9B 级领先模型最多小 16x,吞吐高 12x;\n- Flash-0.8B 可完全离线工作,索引速度可达每分钟 60 张图;\n- 使用 Hydra Architecture 可在更低显存下做 late interaction retrieval + generation;\n- 训练时声称做到了 0% cross-dataset duplication 和 0% eval contamination。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →