实测前沿大模型挖掘固件漏洞:GPT-5.6 与 Opus-5 达成完美检出

evilsocket · x · 2026-08-14

安全团队 Binarly 最新测试评估了前沿大模型在发现 UEFI 固件漏洞方面的能力。结果显示,GPT-5.6 Sol 和 Claude Opus-5 实现了 100% 的完美检测率,而 Kimi K-3 在匹配同等效果的同时成本降低了 43%。

在实际应用于一款旗舰笔记本电脑时,该 AI 流水线共找出 87 个候选漏洞,目前已有 18 个被人工确认。研究指出,单纯依赖模型并不够,结合固件特定上下文和如 VulHunt 这样的二进制分析工具才是关键。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →