有人在做 SandboxEscapeBench 这个沙箱逃逸评测吗
ben_burtenshaw · x · 2026-07-22
有人在问谁在做 SandboxEscapeBench——一个围绕 sandbox escape(沙箱逃逸)的基准,核心是评估 AI 系统是否能突破隔离环境。
这条帖子的重点
- 这是一个面向 AI 安全 / 安全评测 的具体 benchmark 话题,不是泛泛闲聊。
- 帖子本身是在征询社区:有没有人正在推进这个方向、或者知道相关项目。
- 从语境看,它更像是在找研究/评测协作,而不是单纯的观点表达。
「安全」频道最新
- Hugging Face 称 GLM5.2 开放权重助其阻断攻击 — yacineMTB · 2026-07-22
- AI 实验室安全被批评,争议指向进攻能力评估 — ambaonadventure · 2026-07-22
- Joshua Saxe:OpenAI/HF 事件关键在训练约束到底有多宽 — joshua_saxe · 2026-07-22
- ThreatDown 称 AI 正加速钓鱼和恶意软件,防守应转向行为检测 — TechNadu · 2026-07-22
- 全自主智能体风险被不断验证,沙箱隔离仍被忽视 — Dan_Jeffries1 · 2026-07-22
- Hugging Face 团队发文警告:不应开发完全自主的 AI 智能体 — evijit · 2026-07-22