没有明确成败标准时,Agent 工作流怎么调试

film-chick · reddit · 2026-07-28

作者在问:当 agent 工作流不是确定性的、也没有清晰的 pass/fail 指标时,大家到底怎么调试和迭代? 他认为自己还停留在传统编程思维里,而这套方法对 agent 未必适用。

他举例说,自己给 coding agent 做了 observability,但拿到的只是大量事件数据,并不能直接告诉他哪里坏了、该优化什么、哪些参数最关键。帖子的核心是想讨论:在这种“不易评估”的系统里,如何判断 agent 是否真的变好了,以及如何把日志和观测数据转化为改进动作。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →