同一仓库跑一周后,三款编码 Agent 的翻车点很一致
AIcademy-academy · reddit · 2026-07-25
作者在同一个真实项目上,把 Claude Code、Codex、Gemini CLI 当作 coding agent 连续跑了一周,对它们的实际差异做了对比。
主要结论
- Claude Code:多步任务的上下文保持最好,改多个文件时不容易跑偏;缺点是会很快烧预算,最好每个任务新开会话并严格控 scope。
- Codex:最“字面执行”,对描述明确的改动很稳;但一旦指令含糊,就容易停住,或者只做最小修改。
- Gemini CLI:能处理更大的上下文,适合一次性让它看很多文件;但稳定性不如前两者,同样提示词的结果波动更大。
实操层面的共识
作者最后认为,真正决定效果的不是工具切换,而是工作方式:
- 保持一个 context file
- 把任务拆成小步
- 先让 agent 给计划,再允许它改代码
「编程与Agent」频道最新
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11