25 年老程序员用 Opus 写码、Codex 挑刺,月烧 $400 求更优编排
Due_Warthog749 · reddit · 2026-09-15
一位有 25+ 年经验、已完全不动手写代码的开发者分享了一年多的多 LLM 协作工作流,并征求同行反馈。
当前工作流
- 用 Opus(有时 Fable)做构思与设计;然后强制让 Codex Astra 对计划做对抗性审查;Opus 写代码后再由 Astra 复审
- 每次代码完成后跑一套 11 个 agent 的多智能体评审,并生成对抗性测试、混沌测试、规模测试、变异测试
- 项目累计超过 60,000 条测试,还安排 agent 检查测试本身是否有效而非凑数通过
痛点与问题
- 这套流程很慢(常花 5 倍时间),但作者认为换来的是超过多数人类团队的代码质量
- Codex 20x + Claude 20x 每月共 $400,经常耗尽 Opus 周额度
- 作者有 DGX Spark,在考虑是否花约 $15K 买 RTX 6000 Pro,让 Qwen 3.8 27B 这类开源模型承担大部分编码,并寻找最适合做编排/编码分工的模型组合
「编程与Agent」频道最新
- 模型说『做完了』就算数吗:AI 协作需要可审计的证据链 — Patient_Box9033 · 2026-09-16
- Gumloop 推出 Model Router:混合开源与前沿模型省约 35% 成本 — aronkor · 2026-09-16
- NoSpoon agent 10-15 分钟自主产出 5 分钟动画剧集 — Kyrannio · 2026-09-16
- Travis Oliphant 提出开放 Frame 规范:让机构上下文可拥有而非 rented prompt — teoliphant · 2026-09-16
- Salesforce Dreamforce 现场聚焦 Agent,Benioff 高调欢迎"Claudeforce" — omarsar0 · 2026-09-16
- 管理 10-20 个编码 Agent 该用什么?最佳 IDE 可能不是 IDE — rseroter · 2026-09-16