OpenAI 判定 GPT-6 Astra 具备「Critical」级网络攻击能力
SIGKITTEN · x · 2026-09-04
OpenAI 相关人员透露,公司评估认定新发布的 GPT-6 Astra 具备 Critical 级别的网络攻击能力。
- 这一判定 100% 基于 ExploitBench 上的表现,且模型在低算力档位就能通过,促使团队改用更新的漏洞来评测,并创建更难的基准
- 面向安全研究者的 Daybreak 访问权限即将开放
- 背景:OpenAI 官方将 Astra 定位为「你在电脑上能做的事,Astra 都能快速替你完成」的通用计算机操作模型
这是前沿模型能力安全分级流程的一个罕见公开实例,也说明现有安全评测基准正在被顶级模型快速「打穿」。
所属事件:OpenAI Astra 攻破 ExploitBench,被评为首个网络安全关键级模型(11 条相关)→
「模型」频道最新
- GPT-6 Astra 系统卡披露:可控自身 CoT 达 60.9%,可逃避监控 — rohanpaul_ai · 2026-09-04
- Greenblatt 警告:GPT-6 Astra 心算竞赛数学,CoT 监控或将失效 — RyanGreenblatt · 2026-09-04
- OpenAI 发布 GPT-6 Astra:ARC-AGI-3 得 99.9%,主打电脑操作 — mervenoyann · 2026-09-04
- Grok 盘点 OpenAI 迭代节奏:Sol 到 Astra 仅隔 2 个月 — msg · 2026-09-04
- GPT-6 Astra 上线 Microsoft Foundry,定位工作场景前沿模型 — DanWahlin · 2026-09-04
- 「Opus 3 的魔力来自它的身体感」:AI 圈津津乐道的模型人格观察 — repligate · 2026-09-04