AAV 提出在意图与执行间加独立授权层治理 AI Agent
CarlosMarreroAAV · reddit · 2026-09-04
作者指出越来越多 agent 直接接触生产系统(API、数据库、邮件、MCP 工具、基础设施),但很多架构里最后一道安全边界只是「prompt 告诉 agent 别那么做」,这远远不够——像执行 prod.database.delete() 这种操作,不应由 agent 自己说了算。
他主张在意图与执行之间放一个独立控制层,回答:谁在请求?这个 agent 允许用这个工具吗?适用什么策略?风险多大?是否需要人工审批?实际执行了什么?审计记录能否防篡改?
其产品 AAV(Agent Action Verifier)的模型是:agent 请求动作 → AAV 评估身份+策略+风险 → ALLOW/DENY/REQUIREAPPROVAL → 授权执行 → 可验证回执,已在生产运行,并开放 15 天免费试用征求真实压力测试。
核心开放问题:治理应放在 agent/框架内部,还是 agent 永远不该被信任来治理自己的行为?
「编程与Agent」频道最新
- 开发者吐槽 Codex 优化数小时却看错标签列,缺乏常识与好奇 — ivan_bezdomny · 2026-09-04
- 零开发经验第 3 天:全 AI 工作流做 cozy 游戏,工具链全公开 — Gambo7592 · 2026-09-04
- 新加坡 ChatGPT Sites 黑客松 43 个项目开放投票 — gabrielchua · 2026-09-04
- img2threejs 爆火解析:一张照片靠 LLM 写代码生成可编辑 3D 模型 — maier_ak · 2026-09-04
- 开发者给 AI 助手 ghost 加语音聊天,可直接口述查看 agent 编排状态 — BLUECOW009 · 2026-09-04
- 从业者实测:监控工具调用序列比读 CoT 信号更强 — joshua_saxe · 2026-09-04