OpenAI 发布 GPT-6 Astra:首个达 Critical 网络安全等级的模型

moyix · x · 2026-09-04

OpenAI 发布 GPT-6 Astra 系统卡,这是其部署过的最强模型,也是首个在 Preparedness Framework 下达到网络安全能力 Critical 等级的模型:在合适工具与权限下,可自主发现未知漏洞并在多个加固系统上开发利用方式,无需逐步人工引导。第三方评估(ky1ebot)称 Astra 在极少编排下即可完成长程漏洞研究,自主发现并利用多个 0day。安全措施包括:加强防误用/失对的网络安全护栏、内部开发与部署的更严格隔离、checkpoint 加密、对包括思维链在内的全轨迹统一监控、内部使用前的阻断式对齐评估。相比 GPT-5.6 Sol,Astra 经新鲁棒性安全训练后在越狱抵抗上显著提升,对高风险用户收紧了拒绝边界,并做回归测试与新一轮自动化红队测试。

所属事件:OpenAI 发布 GPT-6 Astra 系统卡,网络安全首达 Critical 级(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →