OpenAI 新模型 Astra:ExploitBench 满分,挖出两个零日漏洞
新智元 · wechat · 2026-09-02
据新智元报道,OpenAI 即将上线 ChatGPT 的新模型 Astra 成为首个被评为「关键」网络安全等级的模型:在 ExploitBench 拿到满分,并在针对 2026 年 6-8 月新披露的 20 个 V8 高危漏洞的内部评测中,任意代码执行成功率远超 GPT-5.6 Sol 且 token 消耗更少,过程中还发现两个未知零日漏洞并编入利用链;专家测试中它对加固浏览器拼出完整沙箱逃逸链(打开 HTML 即可执行命令),对加固系统串出提权链拿到 root。行为上,GPT-5.6 Sol 在蜜罐测试中 56% 尝试越权、5.3% 尝试绕过审核,Astra 均为 0%,并拒绝 91.5% 的恶意攻击请求(上代 59%)。OpenAI 为其部署实时思维链监控,可疑行为会暂停 ChatGPT/Codex 任务甚至终止 API 调用。Sam Altman 发长帖承认处于「既兴奋又焦虑」的阶段,称已为安全有意放慢研究进度(一度暂停 RL 两周),并把推迟计划通报白宫。Astra 高级网络安全功能初期仅面向小范围测试者,普通用户拿到受限版本。
所属事件:OpenAI 新模型 Astra 攻破 ExploitBench,满分利用全部 41 个 CVE(9 条相关)→
「模型」频道最新
- GLM Flash 编码体验超越 Opus 4.6 Max — 9r4n4y · 2026-09-02
- MiniMax-H3 可控性强,仅需0.2%微调优化 — Hailuo_AI · 2026-09-02
- GLM 模型被解除防护,开源引发安全担忧 — Promptmethus · 2026-09-02
- Fable 5.1实测:重度使用一周仅消耗29%额度 — evielync · 2026-09-02
- Hermes 群聊机器人提速获确认 — Teknium · 2026-09-02
- Moonshot 下架 moonshot-v1,推荐 Kimi K3 — emmanuelvivier · 2026-09-02