生产级 agent 不能只靠循环内重试,副作用要持久化
Delicious-Energy7016 · reddit · 2026-07-29
作者在把一个真正有写权限的 agent 推到生产后,踩到一个很典型但常被低估的问题:agent 循环里的重试逻辑会和进程一起死掉。
- Demo 里看起来一切正常:模型调用工具、工具打 API、再套个 .withretry() 就完事。
- 但生产里 LLM 往往要思考几十秒,容器可能在中途被回收;这时原本存在内存里的重试状态直接丢失。
- 结果就是:有时调用根本没发出去,有时会发两次。
- 作者的结论是:带副作用的工具调用不应被当成对话的一部分,而应被当成一个持久化 job。
- 更稳妥的做法是给它配上持久化重试、退避、幂等键,以及清晰的执行记录。
- 现在他会把涉及金钱或外部状态的操作交给 durable execution,再让 agent 发起并异步拿结果。
所属事件:生产级Agent执行陷阱:重试不等于安全恢复(2 条相关)→
「编程与Agent」频道最新
- Plannator 发布技能:用 HTML 生成 Agent 交互原型 — tom_doerr · 2026-08-24
- DocketBird MCP 服务器:支持搜索下载法院文档 — modelcontextprotocol · 2026-08-24
- AgentLux MCP 服务器:支持市场和社交流程 — modelcontextprotocol · 2026-08-24
- MongoDB 发布 Agent 工具包,让编码助手精通数据库 — TheTuringPost · 2026-08-24
- 开发软件前先让 Agent 查开源库,99% 的情况是正解 — generativist · 2026-08-24
- 开发者瓶颈不在 AI 上下文,而在人脑认知负荷 — Vidhrohi · 2026-08-24