LLM 失败重试会打死 MCP 服务器,agentgateway 限流实战
pjausovec · x · 2026-08-18
一篇 Cloud Native Deep Dive 的实践文章解释了为什么 MCP 服务器必须做限流:LLM 遇到错误会默认不断重试以满足用户,没有限流的 MCP 调用循环可能反复冲击服务器,造成类似内存泄漏式的资源耗尽——服务崩溃、内存被吃光、API 账单爆炸甚至自我 DOS。
作者的解法是用 agentgateway 在 Kubernetes 上实施限流:将 GitHub Copilot MCP Server 的调用上限设为每分钟 10 次请求,第 11 次调用会收到干净的 429 响应。文中给出了动手复现的前置条件:一个本地 k8s 集群(Kind 或 Minikube 即可)、安装好的 agentgateway 和一个 GitHub 账号。核心结论:把 MCP 推上生产前,先补上限流。
「编程与Agent」频道最新
- 开发者称 Go 语言适配 AI 编程 Agent 效果远超 Rust — dosco · 2026-08-18
- Claude Code CLI 优化 CPU 耗能,P99 峰值降低 50% — dsp_ · 2026-08-18
- DeepTeam 开源框架走红:给 LLM 与 Agent 做渗透测试 — tom_doerr · 2026-08-18
- 博主用 LLM 调用替代价值模型,agent 训练奖励方案再演进 — cephaloform · 2026-08-18
- 腾讯开源 UI-Mate-27B:截图驱动的长程桌面 GUI 智能体 — pmttyji · 2026-08-18
- 开发者吐槽:强模型会「自造复杂度」,agent 产码仍难维护 — aiamblichus · 2026-08-18