新基准 SRE-Bench:测试大模型逆向分析二进制文件能力

teortaxesTex · x · 2026-08-13

现有 AI 网络安全基准多聚焦于源代码漏洞挖掘,但现实中防御者与攻击者面对的核心软件(如专有软件、固件和恶意软件)通常仅以二进制形式存在。

SRE-Bench 旨在填补这一空白,专门测试大模型对二进制文件进行逆向工程并理解其行为的能力,为评估 AI 在实际安全场景中的表现提供了新维度。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →