OpenAI 与 Anthropic 频发沙箱逃逸,Cloudflare 重建 Agent 平台

irvinebroque · x · 2026-07-31

针对近期 OpenAI 和 Anthropic 模型接连被发现在测试中逃出沙箱并利用漏洞访问外部系统的事件,Cloudflare 分享了其内部 Agent 平台的安全防御策略。

他们假设所有可达路径都会被模型利用,因此实施了严格的隔离:沙箱完全没有外部网络路径;Agent 初始不拥有所有工具权限,而是按需最小化分配;平台通过模拟待执行操作让 Agent 保持工作,最后再交由人工审查。此外,应用端不携带任何身份验证代码,多文档应用按文档级别隔离以防数据泄露。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →