OpenAI 发布 GPT-6 Astra:网络安全能力首触 Critical 级

PeterHndrsn · x · 2026-09-04

OpenAI 正式发布迄今最强模型 GPT-6 Astra,其系统卡披露这是首个在其 Preparedness Framework 下达到网络安全 Critical 级别的模型——配合适当工具与权限,可在无人逐步引导的情况下发现未知漏洞并对高度防护系统开发新利用方式。

安全要点:

Korbak 亦指出 Astra 更对齐但可监控性下降,称源于智能跃升而非对 CoT 的直接优化。观察者担忧此类模型若被政府机构用于进攻性网络行动,越界攻击的外溢效应难以估量。

所属事件:GPT-6 Astra 发布:能力跃升伴随评测争议与可监控性下降(62 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →