同一句话测四款 AI 规划工具:最少 8 步最多 54 步差距六倍

SSShken · reddit · 2026-09-12

作者用 Claude Code + Opus 5 作为执行 agent,把同一个「单页周计划应用」的需求分别跑过四款 AI 规划工具(OpenSpec、Spec Kit、BMAD、Kiro),统计从「有想法」到「agent 可以开工」所需的手动操作数。结果差距高达六倍:OpenSpec 只要 8 步;Spec Kit 首个 prompt 4 步、完整任务列表 14 步;BMAD 10 步且不产出任务列表;Kiro 最重,15 步才到首个 prompt、54 步才到完整计划,其中 32 步是在点权限弹窗的 Allow。

其他发现:四款工具中有三款问了同一个关于周格式的澄清问题;没有一款提供编辑任务的途径;四款全都加了没人要求的删除功能;同一句话输进去,四款推荐了四套不同的技术栈。只有 Kiro 要求注册账号和管理员权限;Spec Kit 的 README 里带的命令在手动找到 release tag 之前根本跑不通。作者认为「想法→agent 可开工」之间的操作数是被忽视的关键指标,并想知道这套差距在真实大项目里是否依然成立。

所属事件:同一需求实测四款 AI 规划工具:步骤数相差六倍(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →