传 OpenAI 推出「关键级」安全模型 Astra,能自主发现零日漏洞
BLCNYY · x · 2026-09-02
据爆料,OpenAI 发布了首个在网络安全领域被评为“关键”级别的模型 Astra。其主要特点如下:
- 实战能力:能够在加固系统中自主发现并利用未知漏洞,测试期间发现了两个真实的零日漏洞。
- 安全防护:针对滥用和模型失控行为加强了安全护栏,发布曾因此延期。测试中拒绝 91.5% 的网络越狱尝试(对比 GPT-5.6 Sol 的 59%),且从未尝试绕过安全控制。
- 部署策略:高级网络功能将首先开放给小型 Alpha 用户组,随后通过 Daybreak Blue 项目向防御方开放。
- 预期影响:启动初期可能会采取过度谨慎的策略,合法任务也可能被暂停。
所属事件:OpenAI 即将发布首个关键级网络能力模型 Astra(6 条相关)→
「模型」频道最新
- RWKV-7 G1j 发布:纯 RNN 架构在 agent 与编码任务大幅增强 — jeremyphoward · 2026-09-02
- Fable 5.1 三十分钟一次成型可用的吉他 VST 插件 — CtrlAltDwayne · 2026-09-02
- Fable 5.1 自选目标解开 373 年历史密码 — rickasaurus · 2026-09-02
- Fable 5.1 模型展示:单次生成的高质量角色渲染 — TAbrodi · 2026-09-02
- Anthropic 安全机制误判:Fable 5.1 测试遭拦截 — GregKamradt · 2026-09-02
- OpenAI 重启大型前沿 RL 训练,Astra 实测获满分 — haider1 · 2026-09-02