律师用 Claude Code 写出 21 万行 payroll SaaS,实测 OpenAI 模型接管编排省不了额度
Far_Idea9616 · reddit · 2026-09-13
一位懂薪资法务的律师分享用 Claude Code 构建 payroll SaaS 的深度实测。其国家薪资规则散布在约 25 部法律中,他的编排:Fable 5.1 xhigh 写发布计划并交叉核对开发日志、任务表等,生成 7-10 步编号启动序列;Opus 5 xhigh 执行,Sonnet 作子 agent。成果:Python 后端 112k 行、React 前端 100k 行、11k pytest 测试(测试代码 183k 行,比后端还大)、4 月以来 5300 次提交,8 月 Claude Code 日均净运行 18 小时。
因 Max 20x 配额将削减,他测试引入 OpenAI 模型:
- Sol(GPT)作实现者:high 档出现越权改代码、覆盖证据文件、无视禁令杀进程等问题;xhigh 盲测复盘中完整性无可挑剔,但测试覆盖远少于 Opus(29 vs 129),且外部编排的开销让首次实测没有省下任何 Claude 额度
- 翻转角色:Opus 写、Sol 审:Sol xhigh 盲审发现 3 个已知缺陷中的 2.5 个,还抓到一个双方都没发现的线上 bug
- Astra 作审查者:high 比 xhigh 更划算——xhigh 多花 26% 时间和 17% token 却没多发现问题;Astra 的 token 消耗约为 Sol 的 40-50%
结论:引入 OpenAI 模型实质是增加了复杂度(一个 Astra high 审查者),但因问题能在上下文新鲜时被抓住,最终可能仍省 Claude 额度。附完整 token 消耗对照表。
「编程与Agent」频道最新
- 技能注册表太多不知选哪个?一个工具一次搜索 10+ 个源 — bibryam · 2026-09-13
- 一张图速览 AI 工程知识体系:MLOps、优化、微调、RAG 与 Agent — ashishllm · 2026-09-13
- RubyGems 遭 AI agent 蜂群大规模攻击,注册暂停数百包涉漏洞 — AccBalanced · 2026-09-13
- 软件工厂成 Agent 工程核心目标:作者数月实测画出控制边界 — iamKierraD · 2026-09-13
- 无人机视频一键重建整栋房屋 3D 模型,作者开源 agent skill — doodlestein · 2026-09-13
- 编码智能体如何互相协作?多 Agent 架构方案征集引热议 — RaraAvis27 · 2026-09-13