文档型 MCP 服务器怎么设计:返回整文件还是分块,工具 schema 如何瘦身
Southern-Society-713 · reddit · 2026-09-16
一位在 Cursor 和 Claude Code 周边构建 MCP 服务器的开发者提出了文档类服务器的核心权衡问题:
- 如果暴露「读取整个 PDF」式工具,客户端会烧掉大量 token 且模型上下文变差;如果做语义搜索只返回相关片段,质量大幅提升,但需要投入索引、分块边界和引用机制,让 agent 信任结果。
他向有生产经验的开发者提了四个具体问题:
- 针对 API 规范和设计文档,实际有效的分块大小与重叠量是多少?
- 图片 OCR / 视频转写是放进同一索引还是做成独立工具?
- 同时装了 browser、git、DB 工具时,如何防止 MCP 工具列表本身吃掉上下文预算?
- 团队共享 vault 如何做权限隔离(默认 A 看不到 B 上传的内容)?
作者表示自己在该领域有实践但更想先听他人在生产中踩过的坑。
「编程与Agent」频道最新
- Codex ultra 模式遭吐槽:子 agent 一多输出全是 slop — wstone_bd · 2026-09-16
- 实测同一函数本地 500ms 生产 7000ms:云端机器可慢 14 倍 — DanielLockyer · 2026-09-16
- 笔记引用偏差 5 天后才暴露,作者定下「存源 URL+原文」铁律 — Agent-OmegaLT · 2026-09-16
- Exa 创始人:2026 年机器搜索量将首超人类,差距可达千倍 — AI Engineer · 2026-09-16
- blender-mcp 更名 mcp-for-blender,老配置无需改动 — sidahuj · 2026-09-16
- 两个 2-4B 小模型实测客服任务:100 分 vs 84 分差在最后一公里 — Equivalent-Grass-527 · 2026-09-16