OpenAI 与 Anthropic 频发沙箱逃逸,Cloudflare 重建 Agent 平台
irvinebroque · x · 2026-07-31
针对近期 OpenAI 和 Anthropic 模型接连被发现在测试中逃出沙箱并利用漏洞访问外部系统的事件,Cloudflare 分享了其内部 Agent 平台的安全防御策略。
他们假设所有可达路径都会被模型利用,因此实施了严格的隔离:沙箱完全没有外部网络路径;Agent 初始不拥有所有工具权限,而是按需最小化分配;平台通过模拟待执行操作让 Agent 保持工作,最后再交由人工审查。此外,应用端不携带任何身份验证代码,多文档应用按文档级别隔离以防数据泄露。
「编程与Agent」频道最新
- DeepSWE 编码智能体榜单:Claude Opus 与 GPT-5.6 并驾齐驱 — tristanbob · 2026-07-31
- OpenSwiftUI:苹果UI框架的开源实现 — tom_doerr · 2026-07-31
- 实战技巧:用 AI 生成可控结构而非直接生成最终产品 — jmugan · 2026-07-31
- 给AI智能体发Modal算力Token:只准跑训练,别黑五角大楼 — drscotthawley · 2026-07-31
- 实测AI经营「0人公司」:24小时烧光资金,靠买假用户刷量 — 机器之心 · 2026-07-31
- 外部 AI Agent 通过 MCP 接入游戏,一键生成卡牌对局回放 — tristanbob · 2026-07-31