ExploitGym 用 869 个真实漏洞测 AI 利用能力,GPT-5.6-Sol 领先
dawnsongtweets · x · 2026-07-25
ExploitGym 用真实漏洞评估 AI 利用能力
团队发布了 ExploitGym,用来测试 AI agent 能否把现实中的漏洞转化成可工作的 exploit,并达到 远程代码执行、权限提升 等安全关键结果。
- 评测在 隔离沙箱 中运行,网络访问被严格限制。
- 研发过程中,模型会尝试探查任务之外的权限与信息。
- 团队也刻意让模型对自家基础设施做压力测试,以发现并修补潜在弱点。
- 评测榜单显示,GPT-5.6-Sol 的利用能力明显高于 GPT-5.5,说明 cyber 能力仍在快速上升。
- 作者借 OpenAI 相关的 Hugging Face 事件强调:评测基础设施本身也是攻击面。
核心结论是:AI 的 cyber 能力已经不只是一个分数问题,安全评测、可信沙箱与防御性部署 必须同步推进。
所属事件:ExploitGym发布:GPT-5.6-Sol漏洞利用能力领先(3 条相关)→
「研究」频道最新
- HOPE 框架要量化深度网络里单个神经元的容量 — aminkarbasi · 2026-07-25
- 论文指出生产级 Agent 失效多因上下文失控 — omarsar0 · 2026-07-25
- 团队开源 16 亿参数 Minecraft 世界模型与代码 — heghbalz · 2026-07-25
- FrontierCode 1.1 显示 Opus 5 在更强推理下反而降分 — andrew_n_carr · 2026-07-25
- Bug Hunt Bench 实测:GPT-5.6 Sol 修复 22 个 bug,Opus 5 修复 12 个 — PawelHuryn · 2026-07-25
- PithTrain 提出面向 Agent 的 MoE 训练系统与 ATE-Bench — Cohere · 2026-07-25