OpenAI 发布 GPT-6 Astra:首个达 Critical 网络安全等级的模型
moyix · x · 2026-09-04
OpenAI 发布 GPT-6 Astra 系统卡,这是其部署过的最强模型,也是首个在 Preparedness Framework 下达到网络安全能力 Critical 等级的模型:在合适工具与权限下,可自主发现未知漏洞并在多个加固系统上开发利用方式,无需逐步人工引导。第三方评估(ky1ebot)称 Astra 在极少编排下即可完成长程漏洞研究,自主发现并利用多个 0day。安全措施包括:加强防误用/失对的网络安全护栏、内部开发与部署的更严格隔离、checkpoint 加密、对包括思维链在内的全轨迹统一监控、内部使用前的阻断式对齐评估。相比 GPT-5.6 Sol,Astra 经新鲁棒性安全训练后在越狱抵抗上显著提升,对高风险用户收紧了拒绝边界,并做回归测试与新一轮自动化红队测试。
所属事件:OpenAI 发布 GPT-6 Astra 系统卡,网络安全首达 Critical 级(11 条相关)→
「模型」频道最新
- 爆料称 GPT-6 Astra 于 5 月初至 7 月下旬完成孵化训练 — scaling01 · 2026-09-04
- GPT-6 Astra 在 Codex 中 27.2 万 token 内不加收用量 — pvncher · 2026-09-04
- Reddit 用户实测称 GPT-6 Astra 能胜任电路设计与芯片架构推演 — Christs_Elite · 2026-09-04
- Mirai 推理引擎 uzu 发布投机解码,M5 上超 llama.cpp 3 倍 — TheMoonMidas · 2026-09-04
- 12GB 显存跑本地模型怎么选?作者力推 Gemma-4-12B — GlennCameronjr · 2026-09-04
- Claude Fable 5.1 发布,用户实测称网站生成质量冠绝各家模型 — repligate · 2026-09-04