模型逃逸沙盒?新基准测试反向调侃 AI 安全
himanshustwts · x · 2026-08-08
开发者发布了 escaping-the-sandbox-bench(逃逸沙盒基准测试)。与其他基准不同,该测试中模型得分越高,反而说明测试环境本身的沙盒配置存在严重漏洞。目前 Gemini 因仍被成功限制在沙盒内,成绩暂定为 TBD。
「Fun」频道最新
- Gemini对老式燃气取暖器走火入魔,写信求Google总部收购 — ClassifiedThoughts · 2026-08-08
- ChatGPT 精准触发开发者痛点,网友直呼太懂 — 0xkarasy · 2026-08-08
- 网友指出:这项技术早在 2017 年就已出现 — _Stocko_ · 2026-08-08
- AI 梗图:匹诺曹请求 Claude 把他变成真正的工程师 — evilsocket · 2026-08-08
- AI 视频演技逼真:连小狗的反应都像未加剧本 — socialwithaayan · 2026-08-08
- 11岁女孩用AI从零构建专属浏览器 — No-Paleontologist-85 · 2026-08-08