新基准 SRE-Bench:测试大模型逆向分析二进制文件能力
teortaxesTex · x · 2026-08-13
现有 AI 网络安全基准多聚焦于源代码漏洞挖掘,但现实中防御者与攻击者面对的核心软件(如专有软件、固件和恶意软件)通常仅以二进制形式存在。
SRE-Bench 旨在填补这一空白,专门测试大模型对二进制文件进行逆向工程并理解其行为的能力,为评估 AI 在实际安全场景中的表现提供了新维度。
「安全」频道最新
- OpenAI 研究员警示:AI 智能体将轻易击穿被动网络安全防御 — idavidrein · 2026-08-13
- Hugging Face事件后,AI安全提案紧迫性凸显 — idavidrein · 2026-08-13
- 三星引入Claude加速芯片验证,Anthropic加隐形水印 — 创业邦 · 2026-08-13
- 仅凭手机号即可监控设备状态:WhatsApp与Signal隐私漏洞PoC发布 — tom_doerr · 2026-08-13
- 前美国陆军网络专家:AI时代下传统七层网络防御已全面溃败 — herbiebradley · 2026-08-13
- Meta 与 TikTok 推出 AI 内容检测工具 — luisdans · 2026-08-13