Qdrant 实测检索候选深度:扩到 500 只提升上限 0.28,实际分数几乎不动
qdrant_engine · x · 2026-09-21
Qdrant 发布检索候选深度(candidate depth)实测:在 5 个公开数据集上,把候选数从 10 扩到 500 可让理论上限 nDCG@10 最多提升 0.28,但当前管线实际分数变化不超过 0.01——说明问题常不在「没检索到」,而在排序不够高。
调参建议
- 有下游 reranker 时,从 limit 100 和 200 起测,视为起点而非生产默认(limit 按分片生效,reranker 要给每个候选打分)。
- 提高 hnswef 前,先用精确搜索对比近似召回;若召回已平台期,加大只会徒增延迟。
- 内存吃紧时先试量化再考虑砍候选深度。
文章还给了调参前的基线检查方法,实用性强。
「编程与Agent」频道最新
- Gradio Workflow 登上 Product Hunt:拖拽节点搭 AI 流水线 — Gradio · 2026-09-21
- Shopify CEO:Tobi 称 MCP vs CLI 之争吵错了层次,关键在持久状态 REPL — _AustinCalvert_ · 2026-09-21
- AWS 发布全托管 AgentCore Runtime,agent 有了常驻无服务器算力 — bookwormengr · 2026-09-21
- 开发者用 Jev 在 Codex 任务中动态调整 GPT-6 推理力度,实测成本降 50% — brandon_galang · 2026-09-21
- 把问题放到 prompt 开头,本地 Qwen 准确率 89%→100%,延迟降 5 倍 — Micha0827 · 2026-09-21
- 开源 auto-router 上线:感知缓存成本,自动为每次请求选最便宜模型 — airesearch12 · 2026-09-21