开启危险命令确认后,coding agent 仍想执行 cd /; rm -rf
julianharris · x · 2026-09-06
开发者 julianharris 分享:即便已为 AI agent 设置「危险命令需确认」机制,仍多次撞见 agent 生成类似 cd /; rm -rf 的毁灭性命令,幸好被确认机制拦下。案例说明在让 agent 自主执行 shell 命令时,命令白名单/确认机制等护栏仍是必备,而非可选项。
「编程与Agent」频道最新
- Claude Code 2.1.263 更新:prompt token 涨 16%,系统提示占比升至 79% — ClaudeCodeLog · 2026-09-06
- 开发者围观 Fable、Astra、Anima 三 agent 协作建「庇护所」 — RileyRalmuto · 2026-09-06
- 为 RL 训练做确定性奖励:作者用 Astra 构建标题可读性评分函数 — ivan_bezdomny · 2026-09-06
- LangChain 护栏实战:用 middleware 拦截 Agent 风险行为 — kalyan_kpl · 2026-09-06
- 实测 Astra:单文件 Minecraft 一次成型,145 分钟跑通完整世界模拟 — tegridyblues · 2026-09-06
- OpenAI 发 GPT-6 Astra 提示指南:模型太强,SKILL 和 AGENTS.md 规则要大幅删减 — xiaohu · 2026-09-06