MCP 服务器上下文开销实测
Crazyblind · reddit · 2026-07-11
作者开源了一个 CLI:lap,用于测量 agent-facing 接口的上下文窗口税,覆盖 MCP 服务器、OpenAPI 菜单以及本地工具栈。
核心发现
- 20 个公开 MCP 服务器里,Notion 官方服务器单次会话工具定义就要 21,411 tokens。
- Firecrawl 约 18,511 tokens。
- 把 20 个服务器全连上,启动前大约要吃掉 64k tokens。
- sequential-thinking 虽然只有一个工具,但描述很长,也要 921 tokens。
进一步实验
- 把相同工具压缩成更紧凑的签名后,总成本可降到 3,100 tokens,约 -95%。
- lap stack 可以读取你自己的 Claude Desktop / Cursor 配置并统计启动成本。
- lap lint --mcp "<command>" 会检查工具描述缺失、参数未描述、定义过长、缺少 required 字段等问题。
结果与影响
- 作者还做了一个按月刷新的公共 API leaderboard,显示把 OpenAPI 直接转成 MCP 菜单时,总体有 11.2M tokens 的规模,约 82% 的成本似乎可回收。
- 另外,他们还拿规范里“分层 schema”提案做了 token-overhead 实测,发现 discovery tier 平均能省 87%。
- 项目是 MIT 协议,没有产品包装,但作者说实际跑起来通常能在十秒内发现问题,且上游维护者会很快修复。
所属事件:MCP工具Schema致上下文过载及优化实测(3 条相关)→
「编程与Agent」频道最新
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11