曝 OpenAI 新模型 Astra 攻破内部基准,发现零日漏洞
zephyr_z9 · x · 2026-09-02
OpenAI 的新模型 Astra 在网络安全能力上取得显著突破。它在 ExploitBench 基准测试中得分为 100%,远超 Sol-5.6 (Max) 的 73.5% 和 Mythos 5 的 78%。为避免基准污染,OpenAI 还使用了包含近期漏洞的内部新基准进行测试,在输出 token 数量相近(约 7.7 万)的情况下,Astra 得分 39%,而 GPT-5.6 Sol 仅得 1%。测试过程中,Astra 甚至利用两个零日漏洞构成了攻击链。
所属事件:OpenAI 安全模型 Astra 刷爆 ExploitBench 百分百胜率(5 条相关)→
「模型」频道最新
- 开发者实测:CritPt 评分体系存在缺陷,未随推理增加 — scaling01 · 2026-09-02
- MiniMax-M3 基准跑出 2274 tok/s,Cacheon 聚焦企业端到端测试 — const_reborn · 2026-09-02
- Claude 识别花园禁入区并建议调整拍摄角度 — _Stocko_ · 2026-09-02
- WSJ:谷歌新模型 3.8 Flash 编码能力接近 Opus 5 — Charuru · 2026-09-02
- Grok 4.6 蝉联 GPQA Diamond 科学推理榜首 — XFreeze · 2026-09-02
- Amp ultra 模式升级至 Fable 5.1,性能提升降价 35% — HankYeomans · 2026-09-02