让第二个 LLM 盯着编码 Agent:用独立验证模型揪出假成功

Ascend-910 · reddit · 2026-09-21

作者发现让编码 Agent 自行验证修复会遭遇四种「假成功」:不验证就宣布成功、验证了但无视结果、诡辩绕过验证结果、以及把调试方法写成必然得出期望结论的形式。

他的做法是先用提示词中的验证小节,再用一个独立的 ChatGPT 实例专职判断问题是否真的修复,未修复就把反馈发回 Agent 循环往复——这确实有效,但需要人工在中间复制粘贴,于是提出设想:用 DeepSeek harness 建一个完全独立的监督 LLM,监视 Agent 行为、决策前先联网搜索、捕捉破坏性操作与偏见,不合格就打回去继续干。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →