MCPJam 工程师拆解:「MCP 不行」其实是三种不同问题
Paoli99 · reddit · 2026-10-09
MCPJam 员工在构建 eval 时发现,「MCP vs CLI」讨论常把几个不同问题混为一谈:
- 工具间传数据:代理能否把工具 A 的输出用于工具 B?输出若是散文需要先提取数值,结构化输出有帮助,但下游工具也得能接收
- 上下文拥挤:工具定义和返回结果占用上下文,即使描述清晰也无法避免(作者承认其 eval 尚未测量上下文大小)
- 选对工具:以笔记服务器为例,findnotes(按标签过滤)与 searchnotes(全文搜索)——「找 travel 标签的笔记」应调前者;只检查是否调用预期工具的 eval 会在多余调用 searchnotes 时也通过,因此他们同时检查「调了对的」和「没调错的」,再翻转用例并多次运行测一致性
作者强调:单步测试通过不等于整条链路可靠,也不代表代码编排不是更优解。
「编程与Agent」频道最新
- Khan Academy 推出 MCP Server,AI 助手可免密读取课程与视频字幕 — modelcontextprotocol · 2026-10-09
- BAAI 发布研究智能体 AREX:逐条核验答案,BrowseComp 达 82.5% — DeepLearningAI · 2026-10-09
- 用户的 AI agent 自动帮他对比建筑报价单 — dkundel · 2026-10-09
- 16 个月前就断言:Claude Code 正把 agent 工作流和 API 花费吸向 Anthropic — majidmanzarpour · 2026-10-09
- Pydantic AI agent 循环移植到 Go:pydantic-ai-go 开源 — samuelcolvin · 2026-10-09
- 从只能干 10 分钟到常态长任务:Claude Code 一年间的能力跃迁 — majidmanzarpour · 2026-10-09