同一仓库跑一周后,三款编码 Agent 的翻车点很一致
AIcademy-academy · reddit · 2026-07-25
作者在同一个真实项目上,把 Claude Code、Codex、Gemini CLI 当作 coding agent 连续跑了一周,对它们的实际差异做了对比。
主要结论
- Claude Code:多步任务的上下文保持最好,改多个文件时不容易跑偏;缺点是会很快烧预算,最好每个任务新开会话并严格控 scope。
- Codex:最“字面执行”,对描述明确的改动很稳;但一旦指令含糊,就容易停住,或者只做最小修改。
- Gemini CLI:能处理更大的上下文,适合一次性让它看很多文件;但稳定性不如前两者,同样提示词的结果波动更大。
实操层面的共识
作者最后认为,真正决定效果的不是工具切换,而是工作方式:
- 保持一个 context file
- 把任务拆成小步
- 先让 agent 给计划,再允许它改代码
「编程与Agent」频道最新
- Manning 新书教你用 AI 读懂陌生代码库 — ZacharyHuang12 · 2026-07-25
- drskill 可按 trace 审计 agent loadouts、skills 和 MCP 触发 — dbreunig · 2026-07-25
- 面向 RAG 语音机器人与低延迟的 Agent 生产设计 — babySasuk3 · 2026-07-25
- Claude 和 ChatGPT 的 MCP 连接本质相同,只是叫法不同 — philrox_ · 2026-07-25
- 一个 GitHub 仓库收录 100 多个开源 AI Agent 应用,已获 12.7 万星标 — Saboo_Shubham_ · 2026-07-25
- 新工具把 Claude、Cursor 和 Copilot 花费追踪到交付代码 — entelligenceai17 · 2026-07-25