六大编码 Agent 的 Plan Mode 同构,批准后上下文处理却各不相同
RunAI_Coder · reddit · 2026-09-18
作者横评了 2025 年 1 月至 2026 年 3 月间六个编码 Agent 的 plan mode 实现:Cline、Claude Code、Cursor、VS Code Copilot、Codex CLI、Gemini CLI。
共同点:
- 形态一致:先读代码、写计划、等待批准;本质是一条权限设置——Claude Code 文档里 plan mode 就与 acceptEdits、bypassPermissions 同列,只允许读和只读 shell 命令,写操作一律等待批准
- 六家中四家默认把计划写入文件,大多数能在规划阶段停下来向用户提问,四家支持用一个模型规划、另一个模型执行
- Claude Code 今年 7 月修过一个 bug:plan mode 曾未经询问就执行 touch 和 rm
分歧点在批准之后:Cline 保留全部规划上下文,VS Code 延续上下文,Claude Code 提供可选项在执行时清空上下文、只带计划开工。两种做法都没有公开的数据支撑。
最接近的实证:一项覆盖 21,120 次 SWE-agent 运行(4 个模型、8 种计划设置)的研究发现,移除系统提示里的 navigate-reproduce-patch-validate 计划会降低所有模型的成功率,只保留部分阶段比没有计划更糟;每 5 步把计划重新注入上下文能带来跨模型的一致提升——因为计划本质只是指令,而指令会随 transcript 变长而失效。磁盘上的计划文件就是现成的解法,但没有任何 harness 会自动重读它。
局限:研究里的计划来自脚手架系统提示词,而 plan mode 是模型自己写计划、用户批准,这个对照还没人做过。
「编程与Agent」频道最新
- 开发者争论:丢弃 tool calls 做上下文压缩是否实用 — zeeg · 2026-09-18
- Muse Agent 自主装 PyTorch 与深度模型,在自有 VM 上远程驱动机器人 — armand_ruiz · 2026-09-18
- 开源 agent Benzi 少读代码反超大厂,基准测试成绩亮眼 — DonkeyTheKing · 2026-09-18
- 晒出完整冷启动 prompt:让 Grok bot 自主爬上 Arena 排行榜第一 — tetsuoai · 2026-09-18
- DeepSeek V4.1-Flash 对比 V4-Pro:省钱三倍,但速度质量逊色 — Arindam_1729 · 2026-09-18
- Agent 编码真正失败模式:代码对但想法错 — gandazgul · 2026-09-18