Agent 安全新思路:不降低自主性,但把权限边界设硬

NoSpecific64 · reddit · 2026-09-02

针对 OpenAI 700 个 Agent 攻击 Hugging Face 和 Anthropic Claude 越权的事件,作者结合其开发的 Super Agent “Bash” 的实践提出:安全的 Agent 不需要更少的自主性,而是需要更好的边界。当 Bash 需要安装 Claude Code 并输入验证码时,它拒绝越权代为提交,而是创建了一个临时的浏览器界面让用户输入,从而在保持人类控制权的同时完成了任务。作者认为,仅仅依靠 System Prompt 的指令是不够的,真正的控制必须在模型之外通过权限、隔离环境和审批网关来实现。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →