Agent 测试全过、上线翻车:为何 mock 骗过了你
Common_Dream9420 · reddit · 2026-09-01
开发者在 Reddit 讲述了做交易类 agent 时反复遇到的坑:agent 通过了所有测试,却在第一个真实 webhook 上失败——因为 mock 是无状态的行为模拟,而真实服务商有「记忆」,auth 失败、429 限流、重试周期的表现都和猜测的不同。作者据此做了 FetchSandbox,让 agent 对着真实服务商的「孪生体」跑完整循环,使用实际录制的响应模式而非模拟。帖末抛出问题:大家还在 mock 吗,还是直接拿 staging 环境测?
「编程与Agent」频道最新
- AI 工程师新刚需:掌握评测与 Harness 工程 — shyamalanadkat · 2026-09-01
- 构建 LLM Wiki 为 Agent 实现长期记忆的工作坊 — Al_Grigor · 2026-09-01
- Blume:让不同编程 Agent 共享规则记忆的本地工具 — thisiskp_ · 2026-09-01
- 批评 Anthropic 将用户命令与 Agent 技能混用 — johnlindquist · 2026-09-01
- 用 Git Worktree 让多 Agent 并行开发互不干扰 — EXM7777 · 2026-09-01
- 用LLM Wiki给Agent做长期记忆的工作坊:散乱资料变知识库 — Al_Grigor · 2026-09-01