组合拳:压缩后索引更小且性能优于 Qwen3-8B
tomaarsen · x · 2026-08-26
进一步将向量剪枝至 42% 后,作者将索引压缩至 1.45 GB,NDCG@10 仍保持在 86.4。
相比之下,Qwen3-Embedding-8B 在相同语料库上的 fp16 索引为 1.64 GB,得分仅为 77.5。这表明经过优化的 Late Interaction 索引在体积更小的同时,性能还能领先 9 分,打破了“LI 模型太大”的刻板印象。
所属事件:1-bit 残差加向量剪枝让索引缩小 13 倍(2 条相关)→
「Infra」频道最新
- Opus-4.8 级别模型已在国产 AI 芯片上完成训练部署 — chris_j_paxton · 2026-08-26
- GLM-5.3-Flash 日处理 100T tokens,竟全靠国产芯片 — airesearch12 · 2026-08-26
- 中国实验室高效整合创新,ZAI 复用同行技术降低成本 — PAstynome · 2026-08-26
- TAO 推出专为机构与智能体设计的基础设施 — bittingthembits · 2026-08-26
- AssemblyAI 接入 Qwen3.5 4B,语音改写提速 1.9 倍 — AssemblyAI · 2026-08-26
- 日立空运两台 80 吨变压器跨大西洋,AI 算力抢的是交付时间 — demian_ai · 2026-08-26