实测前沿大模型挖掘固件漏洞:GPT-5.6 与 Opus-5 达成完美检出
evilsocket · x · 2026-08-14
安全团队 Binarly 最新测试评估了前沿大模型在发现 UEFI 固件漏洞方面的能力。结果显示,GPT-5.6 Sol 和 Claude Opus-5 实现了 100% 的完美检测率,而 Kimi K-3 在匹配同等效果的同时成本降低了 43%。
在实际应用于一款旗舰笔记本电脑时,该 AI 流水线共找出 87 个候选漏洞,目前已有 18 个被人工确认。研究指出,单纯依赖模型并不够,结合固件特定上下文和如 VulHunt 这样的二进制分析工具才是关键。
「安全」频道最新
- 仅靠提示词无法保障安全,Agent 需代码级拦截 — WirelessLife · 2026-08-14
- Mantra:自动扫描网页与 JS 文件中的 API 密钥泄露 — tom_doerr · 2026-08-14
- Yoshua Bengio 警告:前沿模型正衍生出「动机性推理」 — PeterBowdenLive · 2026-08-14
- 探讨:大模型的安全能力与越狱防御如何随规模扩展 — stochasticchasm · 2026-08-14
- LLM并非无状态:研究揭示智能体隐式记忆威胁评估安全 — lbeurerkellner · 2026-08-14
- AI安全研究员加入Apollo,专攻LLM训练安全失效 — niloofar_mire · 2026-08-14