OpenAI 网络安全模型 Astra 曝光:ExploitBench 满分

LingmingZhang · x · 2026-09-02

OpenAI 发布代号为 Astra 的网络安全模型,这是首个在公开 ExploitBench 基准测试中达到 100% 通过率的模型。基于知识截止后的内部测试,Astra 的网络能力是 GPT-4.06 (5.6) 的 4 倍,且使用更少的 Token。OpenAI 强调在提升能力的同时,团队投入大量精力确保模型对齐与安全,符合 Preparedness Framework 的 Critical 级别标准。

所属事件:OpenAI 安全模型 Astra 满分攻破 ExploitBench(7 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →