开发者吐槽 Codex 写两万六千行测试却交不出功能
boringmarketer · x · 2026-09-29
一位开发者在 X 上分享使用体验:Codex 最大的坑是会写出 26,000 行测试代码,却依然没把功能做完。他认为 Codex 更适合在严格 spec 下当「干活的」或当 reviewer,而不适合放手让它主导整个开发。
相比之下他感觉用 Opus 5.5 的开发速度快得多;目前只在工作流的部分环节使用 Codex,一旦让它「掌舵」效率就明显下降。他向社区征求同类经验。
「编程与Agent」频道最新
- OpenRouter 开源编码模型份额:GLM 5.3 Flash 以 29.2% 居首 — togethercompute · 2026-09-29
- InstaCloud 获 800 万美元种子轮,要做让 Agent 自己管云的 Serverless — Shruti_0810 · 2026-09-29
- 小模型路由比 LLM 快 200 倍便宜 400 倍,AI 软件架构正走向分层智能 — Pavan_Belagatti · 2026-09-29
- 开发者用 Hindsight 记忆库造 SRE 副驾,能拦住「重启数据库」这类坑 — sathvik1233 · 2026-09-29
- VeilMind 原型:跨客户共享 AI 记忆,同时隔离各家隐私经验 — Logical_Leading8882 · 2026-09-29
- 国产开源 skill 复刻 CellMotion 动效,可读懂逻辑随意改 — yihui_indie · 2026-09-29