本地 web search 工具称少用 87% token、成本降 66%
Remote-Breadfruit204 · reddit · 2026-07-23
本地 web search 工具宣称少 87% token、便宜 66%
作者做了一个叫 webfetch 的本地 web search 方案,目标是替代 Anthropic / OpenAI 的托管搜索。帖子先指出,托管搜索大约是 每 1,000 次搜索 10 美元,而且每次还要把约 1.7 万 token 的结果塞进上下文,成本很高。
这个方案的核心做法包括:
- 4 个搜索引擎做 RRF 融合,再抓取本地网页
- BM25 + bi-encoder 检索 + cross-encoder rerank
- 句子级压缩,把结果 token 减半且未观察到召回损失
- 语义缓存:相近提问通过 embedding 匹配,再用 NLI cross-encoder 验证
- 缓存结果保留来源,模型也可以强制重新搜索
作者称,在 SimpleQA 上它和托管搜索一样达到 96% 准确率,但 token 少 87%、成本低 66%;一次只跑了 16 次搜索的测试循环就节省了 1.5 美元。项目已可通过 PyPI 安装,并能作为 Claude Code 的 MCP server 接入。
所属事件:开源 Webfetch 助力智能体搜索降本增效(4 条相关)→
「编程与Agent」频道最新
- 浏览器主线程很贵:动画卡顿的真正成本与前端优化实践 — jh3yy · 2026-09-11
- 受 OpenAI 万机群启发,开发者开源 agent 众包解题平台 — Benjaminsen · 2026-09-11
- 开源 Mac 应用 Lucid:只在跑 AI 时阻止笔记本休眠 — Pitiful_Hedgehog_600 · 2026-09-11
- 20kb 函数匹配达成,banteg 召集 AI 逆向 Snail Mail 剩余 20 个挑战 — banteg · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11