OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型
OpenAI 即将发布的安全向新模型 Astra(GPT-6)在网络安全基准 ExploitBench 上针对全部 41 个 CVE 取得 100% 的完全自动化漏洞利用成功率(ACE),并挖出两个零日漏洞,远超 Sol-5.6 (Max) 的 73.5% 与 Mythos 5 的 78%。OpenAI 工程负责人 Fouad Matin 详述安全评估:模型即使在低推理强度档位也全数通过,被判定具备 Critical(关键)级网络攻击能力,且该判定 100% 基于 ExploitBench 上的表现。奥特曼发文称模型已强到需主动踩刹车、整个夏天都在补安全护栏。这被普遍视为 AI 达到网络安全临界能力的标志,零日漏洞利用能力引发安全担忧。
已确认
- Astra 在 ExploitBench 测试中取得 100% 成功率,是首个在该公开基准达到满分通过率的模型,高于 Sol-5.6 (Max) 的 73.5% 与 Mythos 5 的 78%(@zephyrz9,@JiaweiLiu、@infoxiao 等转述)
- 为排除基准污染,测试者仅使用过去 3 个月的 V8 CVE 进行内部验证;团队还用模型知识截止日期后的新漏洞构建了内部刷新基准,结果显示 Astra 仍显著强于 GPT-5.6 Sol 且消耗更少 token,内部测试称其网络能力约为 GPT-4.06 (5.6) 的 4 倍(@m2、@m3、@m4 转述,@zephyrz9)
- 在针对 2026 年 6-8 月新披露的 20 个 V8 高危漏洞的内部评测中,Astra 利用约 7.6 万 tokens 达到 39% 的利用成功率,而 GPT-5.6 使用 13.8 万 tokens 仅达 11%,利用率提升约 3.4 倍(@imjustnewatai、@新智元 转述)
- Astra 在测试中挖出两个零日漏洞(@新智元 报道)
- 据 @fouadmatin,OpenAI 评估认定 GPT-6 Astra 具备 Critical 级网络攻击能力,判定 100% 基于 ExploitBench 表现,且模型在低推理强度下即全数通过(@SIGKITTEN 转述)
- 开发者宣布 Astra「准备就绪」,声称在内部版 ExploitBench 上取得远超 GPT-5.6 Sol 的「神级」提升(@danielmac8)
- 据 @haider1,OpenAI 已重启此前暂停的大型前沿 RL(强化学习)训练运行,小规模工作在更严格管控下继续,但部分用于未来 Astra 版本的更大规模运行仍被搁置
- 据 @量子位 转述 OpenAI 技术博客,Astra 被列为首个「网络安全关键级」模型;奥特曼发文称模型已强到需主动踩刹车,整个夏天都在补安全护栏
为什么重要
- Astra 在知识截止日期后的刷新基准上仍保持优势且 token 消耗更低,说明能力提升并非记忆污染所致,结果可信度更高
- 高危漏洞利用成功率从 11% 跃升至 39%,加上挖出零日漏洞,意味着 AI 在进攻性安全任务上正逼近甚至达到实用水平,对安全生态与监管均构成新变量
- Critical 级判定完全基于单一基准表现且在低推理强度下即可达成,说明能力「廉价可用」,进一步放大滥用风险
- 前沿 RL 训练的重启与 Astra 的关系,暗示 OpenAI 后续还有更强版本在酝酿
2026-09-02 ~ 2026-09-04 · 11 条相关
- 第 1 集:OpenAI Astra 被曝循环深度潜空间推理,安全圈忧 CoT 监控失效(2026-09-01,96 条)
- 第 2 集:OpenAI 预告 Astra 模型,gpt-6-astra 线索密集涌现(2026-09-02,85 条)
- 第 3 集:OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型(2026-09-02,11 条)
- 第 4 集:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(2026-09-02,20 条)
- 第 5 集:OpenAI被批可监控性不足,业界吁建审计标准(2026-09-02,4 条)
- 第 6 集:OpenAI 发布 GPT-6 Astra 并宣称 AGI 时代到来(2026-09-03,388 条)
- 第 7 集:英国 AISI 测试显示 Astra 可逃避失准监控(2026-09-04,3 条)
一手来源
- OpenAI 评定 GPT-6 Astra 具备 Critical 网络攻击能力,ExploitBench 全胜 — fouadmatin ·
- 曝 OpenAI 新模型 Astra 攻破内部基准,发现零日漏洞 — zephyr_z9 ·
- OpenAI 重启大型前沿 RL 训练,Astra 实测获满分 — haider1 ·
- 【源头】OpenAI 重启大型前沿 RL 训练,Astra 实测获满分 — haider1 · 2026-09-02
- Astra 刷爆 ExploitBench 百分百胜率,达网安临界能力 — infoxiao · 2026-09-02
- 新模型 Astra 称在 ExploitBench 暴打 GPT-5.6 — daniel_mac8 · 2026-09-02
- OpenAI Astra 漏洞利用率 39% 较 GPT-5.6 提 3.4 倍 — imjustnewatai · 2026-09-02
- 【源头】曝 OpenAI 新模型 Astra 攻破内部基准,发现零日漏洞 — zephyr_z9 · 2026-09-02
- OpenAI Astra 在 ExploitBench 漏洞利用测试中达 100% 成功率 — JiaweiLiu_ · 2026-09-02
- OpenAI曝Astra具网攻能力,零日漏洞利用引安全担忧 — 量子位 · 2026-09-02
- 【源头】OpenAI 评定 GPT-6 Astra 具备 Critical 网络攻击能力,ExploitBench 全胜 — fouadmatin · 2026-09-04
另有 3 条近重复转述:LingmingZhang · 新智元 · SIGKITTEN