OpenAI 评定 GPT-6 Astra 具备 Critical 网络攻击能力,ExploitBench 全胜
fouadmatin · x · 2026-09-04
OpenAI 工程负责人 Fouad Matin 详述了对 GPT-6 Astra 的安全评估:模型被判定具备 Critical 级别的网络攻击能力,其中 100% 的判定依据来自 ExploitBench 基准——即使在低推理强度下也全数达标。
评估团队因此转向更新近的真实漏洞做测试,并着手构建难度更高的新基准。他称这标志着「网络安全领域 AGI 时代的到来」。
这是前沿实验室罕见地公开将自家旗舰模型定级为 Critical 网络能力的官方表态。
所属事件:OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型(11 条相关)→
「模型」频道最新
- 开发者实测 Qwen3.8-max-preview xhigh:连续跑了近 24 小时额度未尽 — jasonkneen · 2026-09-22
- 马斯克官宣 Grok 4.7,演示分钟级生成 3D 喷气引擎交互可视化 — elonmusk · 2026-09-22
- GPT-6 Sol、Luna 与 Astra Minor 曝现身 Azure 模型配置 — 141_1337 · 2026-09-22
- 融资 4000 万美元的 Jev,三天后被开源克隆追平 API — Nickabot · 2026-09-22
- 用户称习惯 DeepSeek v4.1 Flash 速度后难换回其他模型 — mariofilhoml · 2026-09-22
- Evolvent AI 联创:国内预训练架构创新领先,后训练数据落后海外半年 — vista8 · 2026-09-22