Gemini CLI 修复「停不住」问题:调度层硬拦截破坏性工具调用
dylanyunlon · ghdev · 2026-09-18
google-gemini/gemini-cli 的一个 P1 级 PR(#29394)指出:Agent 存在强烈的「行动偏好」,用户明确说「先等一下」「只解释别改」时,模型仍会触发 replace、writefile、runshellcommand 等破坏性调用——纯 prompt 指令挡不住 RLHF 带来的完成偏置压过对否定约束的注意力。
修复方案是在调度层做程序化拦截,而非依赖提示词:
- 指令检测服务:用 14 个正则模式识别 4 类暂停指令(EXPLICITWAIT、EXPLAINONLY、NOCHANGESYET、REVIEWFIRST),带否定守卫(避免误判「别等了」「继续」),输出 0.8–0.95 置信度
- 暂停守卫:只拦截写类工具(writefile、replace、runshellcommand、writetodos、invokeagent),保留 readfile、grep、websearch 等只读工具供继续调查
- 被拦截的调用立即返回结构化 [HOLD DIRECTIVE ACTIVE] 错误;headless 两条执行路径同样生效,系统提示词也同步更新
「编程与Agent」频道最新
- 让 Agent 自己部署应用、再当真实用户测试,像高级模糊测试 — lucasmeijer · 2026-09-19
- 开发者经验:禁止 fallback,逼模型把核心功能做对 — Daniel_Farinax · 2026-09-19
- 银行仓库接 AI 问答三个月复盘:模型从来不是难点 — the_darkest_horse · 2026-09-19
- Codex 直接输出图表能力被低估,agent 编码体验再添一环 — Angaisb_ · 2026-09-19
- Notion 设计工程师 Geoffrey Litt 谈 AI 时代「理解成新瓶颈」 — EchoShao8899 · 2026-09-19
- Codex 内置 Images 2.5:先用图像模型重设计页面再实现 — OpenAIDevs · 2026-09-19