实测四种 spec 驱动工具:同一小功能,任务数从 13 到 29 不等
SSShken · reddit · 2026-09-19
作者此前对比过 OpenSpec、Spec Kit、BMAD、Kiro 四个 spec 驱动工作流工具的「上手成本」,被质疑只测了开箱没测实际干活。这次他补了更严格的实验:先用纯 Claude Code 手写一个真实项目(TypeScript + Express + SQLite + React,带真实 git 历史),再给每个工具一份相同副本,下达同一句需求:把任务从一列拖到另一列。
- 实验埋了陷阱:服务端其实早已实现该功能(PATCH 路由和网关都支持 dayindex),任何规划迁移或新端点的行为都算凭空造工作
- 结果:四个工具都完成了需求,且都没动服务端、都没造新端点——全都先读了代码再规划,出乎作者意料
- 差异在别处:一个写了 13 个任务、一个 24、一个 29,还有一个完全不用任务列表;一个加 3 个 dev 依赖前会先问,另一个加 7 个且不问;两个把测试数据留在了数据库里;有一个自己直接 commit 到 main;还有一个要人手点 84 次 Allow,几乎耗光免费额度
所有数据均手工统计、逐个 diff 人工阅读,未借助任何 AI 摘要。作者尚未跑对照组(纯 Claude Code 无工作流做同一需求),那才是判断这层抽象是否值得的关键,留待下次。
所属事件:同一需求实测四款 spec 驱动编码工具:耗时差达 30 倍(2 条相关)→
「编程与Agent」频道最新
- 施密特预言 UI 将消失:未来 90% 网络流量是 AI 代理 — rohanpaul_ai · 2026-09-20
- 用 GPT 6 Astra 做出可游览的桃花源记,配李立宏真人朗诵 — dotey · 2026-09-20
- 开源 demo:Jev+Kimi K3 两级路由,100 封邮件分类仅花 $0.07 — nutlope · 2026-09-20
- Gemini CLI 修复显式指定 Gemini 3 Pro 被静默升级到 3.1 的 Bug — FanouZeng-TT · 2026-09-20
- 多模型互查仍会漂移:作者论证没有模型能监督好自己 — alexcovo_eth · 2026-09-20
- 从入门到生产:10 个 AWS 上的 Agentic AI 实战项目 — _jaydeepkarale · 2026-09-20