人工审批常不是有效控制
MediaPositive4282 · reddit · 2026-07-19
作者认为,很多 agent 系统里的“人工审批”其实并不是控制,只是看起来像控制。常见失效方式有三种:审批节点根本不在 agent 实际执行路径上;人批准的是模型生成的描述而不是精确调用;以及审批者长期习惯性点“同意”,导致门禁沦为形式。 他提出更可靠的做法是把写权限放在审批之后,让 agent 默认只有只读/提议能力,真正的副作用只能由拥有权限的一侧执行。作者补充说,实践里最先出问题的往往不是攻击者,而是重试、重规划带来的重复或错误操作,因此幂等性比很多人以为的更关键。
「编程与Agent」频道最新
- 过于详细的 PLAN.md 可能悄悄毁掉 vibe coding — mark_k · 2026-07-21
- 一个 Skill 让 Codex 通过本地 CLI 调用三种模型 — vista8 · 2026-07-21
- Polyphonic 想做 agent 通用记忆层,但汇总环节截断了两万字报告 — RileyRalmuto · 2026-07-21
- AI 特别适合移植老游戏,编译器给了它强反馈回路 — NikoMcCarty · 2026-07-21
- 开发者实测 AI 辅助移植:LLM 擅长处理编译器反馈循环 — maxleiter · 2026-07-21
- Haystack 3.0 发布:Agent Hooks、Skills 和更轻量核心 — bo_wangbo · 2026-07-21