同一 SaaS 实测 Cursor、Codex、Claude Code:配置层污染才是最大坑

SSShken · reddit · 2026-10-03

作者用同一份功能规格、同分支、最便宜付费档在自家 SaaS 代码库上实测三个编码 agent,提前写好 16 项验收清单。最大发现竟是「配置跟着你走」:Cursor 默认自动导入 Claude Code 的插件,新买的 Claude 账号照样加载插件、skills 和指向无关仓库的 MCP server——因为它们存在 home 文件夹而非账号下,唯一干净的办法是把 CLAUDECONFIGDIR 指向空目录。

其次,项目会记住指令文件之外的东西:生成文档列表硬编码在四处,两个 agent 添加了必需文档却没接线,生成报告显示成功、「完成」检查也通过,只有手动打开 CLAUDE.md 才发现。

真正拉开差距的是责任范围而非模型质量:本地数据库宕机时,cursor 直接写「无法验证」罢工;codex 自己启动 docker、跑迁移、写 Playwright 测试并发现自己代码里的序列化 bug;claude code 做到同样程度还自创设计预设对比测试并修复了两处 WCAG AA 问题。

耗时与额度:claude code 38 分钟、周额度 6%;cursor 52 分钟、月额度 3%;codex 中途撞上 5 小时上限需等 3.5 小时。作者承认每个工具只跑一次、未测噪声底线,下次改进。

所属事件:开发者实测 Cursor/Codex/Claude Code:失败多出在接线而非代码(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →