Weaviate 引入测试时计算缩放,大幅提升复杂检索质量
CShorten30 · x · 2026-08-11
Weaviate 在其查询智能体的搜索模式中引入了 effort 参数,允许开发者控制测试时计算(test-time compute)的投入,以权衡检索质量与延迟。
- 三档算力模式:提供 medium(中等)、high(高)和 ultrahigh(超高)三个等级。
- 性能提升:在最困难的推理密集型基准测试 BRIGHT Biology 上,ultrahigh 模式将 nDCG@10 提升至 57.5,而单独使用混合搜索仅为 13.0。
- 工作原理:高算力模式下,智能体会投入更多计算来分解复杂查询,并对结果进行更彻底的重排;低算力模式则牺牲部分深度以换取速度和成本优势。
该功能已在 weaviate-agents 1.8.0 和 agents-typescript-client 1.7.0 中可用。
「编程与Agent」频道最新
- 智能体调用 93% 可用 30B 小模型,LangChain 实测降本 70% — LangChain · 2026-08-12
- 别让 AI 只做计划,让它生成 Markdown 清单 — JnBrymn · 2026-08-12
- AI 编码时代的代码质量,取决于你设的约束 — rseroter · 2026-08-12
- Agent跑十次成功率骤降:论文揭示计算机任务可靠性陷阱 — xwang_lk · 2026-08-12
- Cursor 被曝即将推出 Composer 3,社区期待评测数据 — kimmonismus · 2026-08-12
- 基于 x402 协议实现智能体反向查询来电号码 — MurrLincoln · 2026-08-12