AAV 提出在意图与执行间加独立授权层治理 AI Agent

CarlosMarreroAAV · reddit · 2026-09-04

作者指出越来越多 agent 直接接触生产系统(API、数据库、邮件、MCP 工具、基础设施),但很多架构里最后一道安全边界只是「prompt 告诉 agent 别那么做」,这远远不够——像执行 prod.database.delete() 这种操作,不应由 agent 自己说了算。

他主张在意图与执行之间放一个独立控制层,回答:谁在请求?这个 agent 允许用这个工具吗?适用什么策略?风险多大?是否需要人工审批?实际执行了什么?审计记录能否防篡改?

其产品 AAV(Agent Action Verifier)的模型是:agent 请求动作 → AAV 评估身份+策略+风险 → ALLOW/DENY/REQUIREAPPROVAL → 授权执行 → 可验证回执,已在生产运行,并开放 15 天免费试用征求真实压力测试。

核心开放问题:治理应放在 agent/框架内部,还是 agent 永远不该被信任来治理自己的行为?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →