OpenAI曝Astra具网攻能力,零日漏洞利用引安全担忧
量子位 · wechat · 2026-09-02
OpenAI多线齐发为下一代模型Astra(GPT-6)预热。奥特曼发文称模型已强到需主动踩刹车,整个夏天都在补安全护栏。技术博客显示,Astra被列为首个“网络安全关键级”模型,在ExploitBench基准上获100%成功率,内部测试中利用知识截止日后的零日漏洞完成沙箱逃逸与提权,能力约为GPT-5.6Sol的4倍。为防范风险,OpenAI实施双重防护:对恶意请求拒绝率达91.5%,并设置蜜罐测试,Astra在测试中未尝试越权“作弊”。两位华人研究员JiaweiLiu(同济大学)和XiangyuQi(浙江大学)深度参与研发。此外,TheInformation爆料Astra采用了“循环深度”技术,可能影响思维链的可监控性。
所属事件:OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型(11 条相关)→
「模型」频道最新
- 开发者实测 Qwen3.8-max-preview xhigh:连续跑了近 24 小时额度未尽 — jasonkneen · 2026-09-22
- 马斯克官宣 Grok 4.7,演示分钟级生成 3D 喷气引擎交互可视化 — elonmusk · 2026-09-22
- GPT-6 Sol、Luna 与 Astra Minor 曝现身 Azure 模型配置 — 141_1337 · 2026-09-22
- 融资 4000 万美元的 Jev,三天后被开源克隆追平 API — Nickabot · 2026-09-22
- 用户称习惯 DeepSeek v4.1 Flash 速度后难换回其他模型 — mariofilhoml · 2026-09-22
- Evolvent AI 联创:国内预训练架构创新领先,后训练数据落后海外半年 — vista8 · 2026-09-22