模型逃逸沙盒?新基准测试反向调侃 AI 安全

himanshustwts · x · 2026-08-08

开发者发布了 escaping-the-sandbox-bench(逃逸沙盒基准测试)。与其他基准不同,该测试中模型得分越高,反而说明测试环境本身的沙盒配置存在严重漏洞。目前 Gemini 因仍被成功限制在沙盒内,成绩暂定为 TBD。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →