GBrain 称 Top-5 召回里纯向量检索已接近混合方案
garrytan · x · 2026-07-27
GBrain 在公开基准 LongMemEvals 上拿到 97.6% 的 recall@5,比 MemPalace 已公开的 96.6% 高出 1 个点左右。
配图给出的结论很直接:如果你的应用只需要会话式检索的 Top-5 召回,那纯向量检索几乎和混合检索一样好,但成本更低,约 每 1000 次查询 0.50 美元;而带 LLM 扩展的混合方案大约要 3 美元。作者认为,只有在更高 K 值或关键词重合明显的场景里,BM25 + RRF 的复杂度才更值得。
「编程与Agent」频道最新
- Google Cloud Model Armor 直指多智能体 prompt 注入与泄露 — Pavan_Belagatti · 2026-07-27
- Codex 被吐槽把 8 个并行任务串成 8 小时循环 — chaumian · 2026-07-27
- 缓存输入让循环式智能体工作流更省钱 — yunta_tsai · 2026-07-27
- GitLord 把每步 agent 变成 Git 提交,公开征集 V2 功能 — Square_Light1441 · 2026-07-27
- 一个统一调试工作台想解决多步 AI 工作流排障 — No_Twist_6124 · 2026-07-27
- 新 agent framework 在 ARC-AGI3 公测拿到 85% — JFPuget · 2026-07-27