让第二个 LLM 盯着编码 Agent:用独立验证模型揪出假成功
Ascend-910 · reddit · 2026-09-21
作者发现让编码 Agent 自行验证修复会遭遇四种「假成功」:不验证就宣布成功、验证了但无视结果、诡辩绕过验证结果、以及把调试方法写成必然得出期望结论的形式。
他的做法是先用提示词中的验证小节,再用一个独立的 ChatGPT 实例专职判断问题是否真的修复,未修复就把反馈发回 Agent 循环往复——这确实有效,但需要人工在中间复制粘贴,于是提出设想:用 DeepSeek harness 建一个完全独立的监督 LLM,监视 Agent 行为、决策前先联网搜索、捕捉破坏性操作与偏见,不合格就打回去继续干。
「编程与Agent」频道最新
- Addy Osmani 演示用 claude plugin eval 自动验证插件是否提升回答 — addyosmani · 2026-09-21
- 开发者呼吁:避免 cache miss 或是提升 Claude Code/Codex 用量上限最关键一招 — chaseleantj · 2026-09-21
- 独立开发者开源 AI 工作流平台获 38 处部署,开始操心维护 — Feathered-Beast · 2026-09-21
- AI 客服 agent 该给谁退款?「动作授权层」该放哪里引热议 — witty_queen123 · 2026-09-21
- 两年从零到 3.5 万美元自由职业收入与首个创业项目的复盘 — PratikKadam_ · 2026-09-21
- ai-toolkit 已支持 Qwen-Image-2.1 LoRA 训练,HF 上尚无现成模型 — reeight · 2026-09-21