MCP工具schema正在吃掉上下文
Ok-Tooth1667 · reddit · 2026-07-12
作者发现把多个 MCP server 接到一个 agent 后,随着工具数增加,工具选择准确率稳定下降,而且和 server 数量近似线性相关。
他分析原因是:每个工具的名称、描述和完整 JSON Schema 都会在每一轮请求里被序列化进上下文。以 4 个 server、约 60 个工具为例,单是工具定义就占了约 11–12k tokens,而系统提示词本身还不到 2k。
他实际改进的做法不是继续减少工具总数,而是减少模型当前可见的工具数量:
- 先暴露一个轻量级的搜索/加载步骤
- 让 agent 先判断需要哪些工具
- 再只把 3–5 个相关工具载入上下文
这样一来:
- 工具块从约 11–12k tokens 降到约 2k
- 路由准确率提升
- 延迟下降
- 总体上下文压力明显减轻
作者最后的结论是:真正影响效果的,不是工具总数,而是活跃上下文里被序列化进去的 schema 体积。
所属事件:MCP工具Schema致上下文过载及优化实测(3 条相关)→
「编程与Agent」频道最新
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11