Agent 系统会走对每一步,却丢了正确状态
Present-Quantity-813 · reddit · 2026-07-24
Agent 系统会“走对一步,却站错位置”
作者指出,ReAct、reflection、图编排这类模式,能限制 agent 下一步“走哪里”,但不能自动证明它还站在正确的任务位置上。系统可能每一步都看起来合理,却已经丢失了经过验证的目标状态、世界状态或证据链。
核心判断
- 作者把可靠性拆成:
- P(正确步骤) = P(正确位置) × P(在正确位置时走对入口)
- 这里的“位置”包括当前目标、世界状态、已接受证据、权限与剩余义务。
- “入口”则是下一次工具调用、状态跳转或动作。
具体问题
- 图结构可以约束可选动作,但不能证明 agent 仍处于正确状态。
- 停止条件在世界变化后可能过期。
- 作者观察到一个系统曾陷入 3 天递归循环,生成 102 个 work items,其中 68% 是修复工作。
抛出的关键问题
终止条件到底应该放在:
- prompt 里
- graph 节点里
- supervisor 里
- budget 里
- 还是外部可验证的状态转移里?
作者进一步追问:当目标和世界状态都已变化时,是什么机制阻止旧证据继续授权下一轮迭代?
「编程与Agent」频道最新
- 一次穿过智能体、黑板与瓶颈的 LangGraph 学习 — Clear-Dimension-6890 · 2026-07-24
- 新 ComfyUI 细化节点用上下文锚定自动放大图像 — blakeem · 2026-07-24
- Codex 接入 GPT Live 语音,可全程语音驱动编码 — op7418 · 2026-07-24
- T3 Code 夜版默认输出 DeepSeek 推理轨迹 — pvncher · 2026-07-24
- AREX 提出内外双循环的递归自改进研究智能体 — _reachsumit · 2026-07-24
- 一个本地开源 Agent Skill 能标出多余的 diff 改动 — Saboo_Shubham_ · 2026-07-24