Codex agent 陷入无尽测试循环,Gemini Flash 却更快交活

not_enough_privacy · reddit · 2026-07-27

一位非开发者用户描述自己在做神经符号知识图谱抽取时,发现 Codex 和 Luna 这类 agent 过于谨慎、速度很慢,还会陷入无休止的测试循环:代码在结构上看似正确,但抽取内容质量却偏离目标,甚至会伤害项目本身。

他提到自己用 Gemini Flash 在 30 分钟内就推进了同样的任务,而 Codex 在相同 brief 下却会过度思考、不断验证,像“被训过头的孩子”一样害怕出错。帖子核心是在问:有没有人也遇到这种 agent 过度防御、过度测试、产出变慢 的问题,以及如何把它拉回“先把活干完”的状态。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →