同一句话测四款 spec 工具:从想法到可开工差距达 6 倍
SSShken · reddit · 2026-09-11
作者用同一句需求(单页周计划应用)、同一台机器、每次干净目录,横向实测四款 spec 驱动开发工具(均经 Claude Code + Opus 5,Kiro 用自带 agent):
- 操作步数:OpenSpec 8 步;Spec Kit 4 步到首个 prompt、14 步到完整任务清单;BMAD 10 步且不产任务清单;Kiro 最重,15 步到首 prompt、54 步到完整计划——其中 32 步是点 Allow 权限弹窗。
- 关键发现:从「我有个想法」到「agent 可以开工」的步数,四款工具相差 6 倍,此前没人量化过。
- 共同问题:其中三款问了同一个关于周格式的澄清问题;四款都没提供编辑任务的方式;四款全都加了个没人要求的删除功能。
- 其他:同一句话,四款工具推荐了四套不同的技术栈;只有 Kiro 要求注册账号和管理员权限;Spec Kit 的 README 里有一条要自己找 release tag 才能用的命令。
「编程与Agent」频道最新
- CopilotKit 开源 OpenBot 获 4.7k 星,主打可完全自有的 AI 同事 — Roger_M_Taylor · 2026-09-11
- 开发者借 OpenAI Astra 做出 Three.js 图形 demo:渲染数学门槛正被 AI 拆掉 — algo_diver · 2026-09-11
- 38.3k 星开源项目:为 Claude Code 打造 39 种编辑级图表设计技能 — adnan_hashmi · 2026-09-11
- 省 Claude 用量的 14 个技巧:更少 token 干更多活 — aitrendz_xyz · 2026-09-11
- T1 强化学习训练终端 Agent:Terminal-Bench 2.1 通过率 43.8% 升至 64.0% — heghbalz · 2026-09-11
- 用 Codex 经 MCP 驱动 DaVinci 剪片:修剪、音频、字幕全交给 AI — _AustinCalvert_ · 2026-09-11