Codex 现在能更稳地并行做大规模 QA

steipete · x · 2026-07-26

作者表示自己一整天都在用 Codex 做大规模并行 QA,发现它现在更擅长理解意图,也更能抓出复杂的行为问题。

他补充说,过去这种流程常常会在 compaction 边界失效,或者模型开始“作弊”;而这次长时间、多分支的测试工作流明显更稳了。

所属事件:AI多代理并行QA能力提升,自动化找虫效率显著(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →