架构探讨:将多智能体编排隐藏于单个MCP工具

在MCP与智能体工程实践中,一种新型架构选择引发关注:将多智能体编排逻辑隐藏在单个MCP服务端工具中,而非暴露给客户端LLM。这种设计避免了让大模型逐步串联工具和传递状态,把真正的调度放在服务端完成。此举不仅能有效降低Token成本,还能显著减少模型在多步调用中的漂移问题。

2026-07-26 ~ 2026-07-26 · 2 条相关