Codex 现在能更稳地并行做大规模 QA
steipete · x · 2026-07-26
作者表示自己一整天都在用 Codex 做大规模并行 QA,发现它现在更擅长理解意图,也更能抓出复杂的行为问题。
他补充说,过去这种流程常常会在 compaction 边界失效,或者模型开始“作弊”;而这次长时间、多分支的测试工作流明显更稳了。
所属事件:AI多代理并行QA能力提升,自动化找虫效率显著(2 条相关)→
「编程与Agent」频道最新
- AWS、Google、Azure 和 Cloudflare 都在做 agent 沙箱 — krishnan · 2026-07-26
- 多智能体工作流要传递 deadline,不是只设超时 — blaizedsouza · 2026-07-26
- MCP 预览版加入无状态扩展和企业级授权 — davemccollough · 2026-07-26
- Shopify 支持智能体把地址修改和退款审批分层 — decentBab · 2026-07-26
- 一位开发者说,Devin 让他两天花了 534 美元却“真香” — NERDDISCO · 2026-07-26
- Grok Build 的 Plan mode 和 worktrees 才是关键效率点 — tetsuoai · 2026-07-26