OpenAI 网络安全模型 Astra 曝光:ExploitBench 满分
LingmingZhang · x · 2026-09-02
OpenAI 发布代号为 Astra 的网络安全模型,这是首个在公开 ExploitBench 基准测试中达到 100% 通过率的模型。基于知识截止后的内部测试,Astra 的网络能力是 GPT-4.06 (5.6) 的 4 倍,且使用更少的 Token。OpenAI 强调在提升能力的同时,团队投入大量精力确保模型对齐与安全,符合 Preparedness Framework 的 Critical 级别标准。
所属事件:OpenAI 安全模型 Astra 满分攻破 ExploitBench(7 条相关)→
「模型」频道最新
- 网友截图证实 Gemini 2.0 Flash 3.8 版本推出 — Maglcite · 2026-09-02
- Fable 5.1 评测:估算能力依然糟糕 — rudrank · 2026-09-02
- Fable 5.1 高度复刻马里奥 1-1 关卡,网友呼吁改考关卡设计 — max_paperclips · 2026-09-02
- 3B 模型 TwIL 在形式推理上击败 120B 开源模型 — Socially-great8275 · 2026-09-02
- 反驳模型缩小论:2T 参数成新常态,KV 缓存年降 10 倍 — zephyr_z9 · 2026-09-02
- 实测对比:V4-Flash-Vision-Exp 代码改进优于 GLM 5.3 — teortaxesTex · 2026-09-02