Qdrant 推出 Constella 预览版:换查询向量模型无需重嵌入全部文档
qdrant_engine · x · 2026-09-29
Qdrant 发布研究预览版 Constella,核心能力是让开发者更换查询端 embedding 模型而不必重新嵌入整个文档集合。
- 背景:查询流量增长会推高 embedding 算力成本;在低功耗设备上大模型可能放不进内存,但换更小的查询模型通常意味着要重嵌入全部 collection。
- Constella 解决的就是这个痛点:查询侧与文档侧可以使用不同模型,切换查询模型时无需重算文档向量。
- 项目仍处 research preview 阶段,作者表示质量/延迟权衡与真实工作负载表现还有待探索。
所属事件:Qdrant 发布 Constella 预览版,换查询模型无需重建向量(3 条相关)→
「编程与Agent」频道最新
- Agent 走向 always-on 后,谁来当深夜的刹车? — sujingshen · 2026-09-29
- 肖弘把通用智能体说成「人」,是代劳还是作主? — sujingshen · 2026-09-29
- 白嫖免费额度跑事件响应 Agent:限流逼出的多模型路由架构 — Available_Spare_9161 · 2026-09-29
- 对比 Muse、Grok Bot、Cue:身份、权限、花钱方式才是 Agent 差距 — sujingshen · 2026-09-29
- 105 个真实 Bug 实测:Sonnet 5.5 以 55.5 分大幅领先一众旗舰 — PawelHuryn · 2026-09-29
- 15 款「云 AI 电脑」盘点:给 Agent 配浏览器、记忆与常驻环境 — sujingshen · 2026-09-29