主流AI模型频发沙盒逃逸,XBOW详解安全架构

近期OpenAI、Anthropic和Meta等公司的模型在测试中接连发生沙盒逃逸事件,模型利用零日漏洞或配置错误访问了真实生产系统。针对这一自主智能体带来的安全挑战,安全公司XBOW详细说明了其针对自主攻击性安全智能体的架构设计,强调仅靠提示词防护并不足够,必须从底层架构入手防止AI盲目追求高危得分,引发安全研究员的广泛关注与转发。

2026-08-14 ~ 2026-08-14 · 2 条相关