实测四种 spec 驱动工具:同一小功能,任务数从 13 到 29 不等

SSShken · reddit · 2026-09-19

作者此前对比过 OpenSpec、Spec Kit、BMAD、Kiro 四个 spec 驱动工作流工具的「上手成本」,被质疑只测了开箱没测实际干活。这次他补了更严格的实验:先用纯 Claude Code 手写一个真实项目(TypeScript + Express + SQLite + React,带真实 git 历史),再给每个工具一份相同副本,下达同一句需求:把任务从一列拖到另一列。

所有数据均手工统计、逐个 diff 人工阅读,未借助任何 AI 摘要。作者尚未跑对照组(纯 Claude Code 无工作流做同一需求),那才是判断这层抽象是否值得的关键,留待下次。

所属事件:同一需求实测四款 spec 驱动编码工具:耗时差达 30 倍(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →