Agent 治理层实测:有人盯着的界面反成安全盲区

作者为自己的开源 agent 加了完整治理层,包括污点账本、不可信输出数据围栏、危险工具审批和内核级 allow/warn/review/block。但实测发现交互界面反成盲区:approve 审批回调在三处调用点从未被传入,包括桌面应用聊天、批处理求解器,以及最意外的、唯一保证有真人面前的终端聊天,导致 62% 正常任务被拒。作者认为解法不是放宽审批,而是给系统一个能提问的人。

2026-09-11 ~ 2026-09-11 · 2 条相关