VultronRetriever检索模型家族发布
madkimchi · reddit · 2026-07-11
Hugging Face 上发布了 VultronRetriever 系列检索模型,强调可在 iPhone 上完全离线运行 Q&A 和文档 embedding。该系列在 MTEB 上取得了很强的成绩:Prime-8B 在各自类别中排名第一、并号称是全局第 1;Core-4.5B 排名第二;Flash-0.8B 也能在边缘设备上运行,并支持更高吞吐。\n\n作者还给出了一些工程卖点:\n- Prime-8B 的索引存储占用比上一代 9B 级领先模型最多小 16x,吞吐高 12x;\n- Flash-0.8B 可完全离线工作,索引速度可达每分钟 60 张图;\n- 使用 Hydra Architecture 可在更低显存下做 late interaction retrieval + generation;\n- 训练时声称做到了 0% cross-dataset duplication 和 0% eval contamination。
「模型」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- Anthropic 调整年龄验证,Claude 不再向未成年人开放 — Muhammad523 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11