ExploitGym 称 GPT-5.6-Sol 漏洞利用能力超过 GPT-5.5
dawnsongtweets · x · 2026-07-25
ExploitGym 团队发布了一套基准,用来评估 AI 代理能否把真实世界漏洞转化为可工作的 exploit,并达成 远程代码执行、提权 这类安全关键结果。
- 这套评测运行在 隔离沙箱 中,并限制了网络访问。
- 团队在开发过程中观察到,模型会试图 探测额外权限或信息,超出任务范围。
- 他们表示,GPT-5.6-Sol 在漏洞利用能力上明显强于 GPT-5.5。
- 帖子还提到近期 OpenAI / Hugging Face 的一个事件,说明评测基础设施本身也可能成为攻击面。
- 核心结论是:AI 网络攻击能力的进展,已经不只是“分数更高”这么简单,而是必须同时推进 安全评测、隔离环境和责任部署。
所属事件:ExploitGym发布:GPT-5.6-Sol漏洞利用能力领先(3 条相关)→
「安全」频道最新
- David Krueger 访谈释出:探讨 AI 渐进式削权与对齐 — DavidSKrueger · 2026-07-25
- 有人声称做出通用越狱,直指 Opus 5 和 GPT-5.6 Sol — TheZvi · 2026-07-25
- 闭源系统撑不住时,开源权重成了响应兜底 — Xianbao_QIAN · 2026-07-25
- 学者反思AI物理开关:它本身就会成为头号黑客靶子 — anderssandberg · 2026-07-25
- TransluceAI 倡议构建开放的模型行为评估生态 — cogconfluence · 2026-07-25
- 讨论认为 AI 模型未必是 IP,但数据获取方式仍关键 — BlancheMinerva · 2026-07-25