人工审批常不是有效控制

MediaPositive4282 · reddit · 2026-07-19

作者认为,很多 agent 系统里的“人工审批”其实并不是控制,只是看起来像控制。常见失效方式有三种:审批节点根本不在 agent 实际执行路径上;人批准的是模型生成的描述而不是精确调用;以及审批者长期习惯性点“同意”,导致门禁沦为形式。 他提出更可靠的做法是把写权限放在审批之后,让 agent 默认只有只读/提议能力,真正的副作用只能由拥有权限的一侧执行。作者补充说,实践里最先出问题的往往不是攻击者,而是重试、重规划带来的重复或错误操作,因此幂等性比很多人以为的更关键。

所属事件:Agent 人工审批被指常成摆设(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →