Anthropic 公布 Claude 在 ExploitBench 上的安全评测结果

TheZvi · x · 2026-07-25

Anthropic 在 ExploitBench 上公布 Claude 表现

帖子分享了 Anthropic 在 ExploitBench 上的最新结果。这个基准主要用于衡量模型在利用链、沙箱逃逸等安全场景中的表现。

图表里对比了几款 Claude 模型,重点结论是:

图注还说明,这组测试是在多个环境和多次 trial 下跑出来的;其中 Full ACEs 指能实现完整利用、达成任意代码执行的攻击结果。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →