同一句话测四款 AI 规划工具:最少 8 步最多 54 步差距六倍
SSShken · reddit · 2026-09-12
作者用 Claude Code + Opus 5 作为执行 agent,把同一个「单页周计划应用」的需求分别跑过四款 AI 规划工具(OpenSpec、Spec Kit、BMAD、Kiro),统计从「有想法」到「agent 可以开工」所需的手动操作数。结果差距高达六倍:OpenSpec 只要 8 步;Spec Kit 首个 prompt 4 步、完整任务列表 14 步;BMAD 10 步且不产出任务列表;Kiro 最重,15 步才到首个 prompt、54 步才到完整计划,其中 32 步是在点权限弹窗的 Allow。
其他发现:四款工具中有三款问了同一个关于周格式的澄清问题;没有一款提供编辑任务的途径;四款全都加了没人要求的删除功能;同一句话输进去,四款推荐了四套不同的技术栈。只有 Kiro 要求注册账号和管理员权限;Spec Kit 的 README 里带的命令在手动找到 release tag 之前根本跑不通。作者认为「想法→agent 可开工」之间的操作数是被忽视的关键指标,并想知道这套差距在真实大项目里是否依然成立。
所属事件:同一需求实测四款 AI 规划工具:步骤数相差六倍(2 条相关)→
「编程与Agent」频道最新
- Codex 应用 26.908 发布:Windows 端 Pets 悬浮控制与新快捷键 — TheMoonMidas · 2026-09-12
- 一句话让 AI 把浏览器 3D 演示移植进 UE5,全程未用 Blender — TheMoonMidas · 2026-09-12
- Jacalazu 提出 agent 价值公式:时长×提示词自我×输出密度 — jacalulu · 2026-09-12
- 开发者工作流拆分:本地任务归 Codex,云端任务迁至 Grok Bot — petergyang · 2026-09-12
- OpenAI 推出 Docs skill 与开发者插件,让 Codex 直接读文档建 Agent — gabrielchua · 2026-09-12
- 做云端 Agent 不用自建轮子,OpenAI Agents API 内置沙箱与多智能体 — gabrielchua · 2026-09-12