Qdrant 推出 Constella:换查询嵌入模型无需重建文档索引
qdrant_engine · x · 2026-09-29
Qdrant 发布研究预览版 Constella,核心思路是让查询侧嵌入模型可以更换而不必对所有文档重新嵌入。其中 Nano 与 Zero 两个模型专门训练为与 Stella 的文档嵌入向量兼容,可在质量与查询延迟之间按需切换:Zero 极其轻量,Nano 则是小型 transformer,检索质量更接近 Stella。对维护大规模向量库的团队,这意味着切换查询模型从「全量重嵌入」变成一次配置。
所属事件:Qdrant 发布 Constella 预览版,换查询模型无需重建向量(3 条相关)→
「Infra」频道最新
- Shaw 吐槽反数据中心者:一边骂算力一边上网自相矛盾 — zealcaiden · 2026-09-29
- 模型推演 2030 年十亿 Agent 虚拟机背后的 CPU 需求与芯片商机 — AccBalanced · 2026-09-29
- Tessera 论文:检索驱动 KV 缓存复用,RAG 服务首字延迟降 3.6 倍 — _reachsumit · 2026-09-29
- Venice 代币化推理积分模式遭跟风,供给过剩隐忧浮现 — 0xJeff · 2026-09-29
- Model Casting:中途换激活函数+L1 稀疏目标,大幅稀疏化 FFN 降 FLOPs — francoisfleuret · 2026-09-29
- antirez:企业配额用完别慌,自建 DGX Spark 与 Mac Ultra 机群托底 — antirez · 2026-09-29