OpenAI Astra 达网络关键级能力,发布将分层限制
OpenAI 代号 Astra 的前沿模型在内部评估中达到其 Preparedness Framework 下的「关键网络安全能力(Critical)」阈值,据称在漏洞识别与利用开发上显著超过 GPT-5.6 Sol。OpenAI 表示计划「很快」公开发布 Astra,但其最先进的网络安全(攻防)能力将采取分层供给:通用能力广泛开放,潜在双刃剑能力窄供给。
已确认
- 据 @ChrisGPT 转述的 OpenAI 内部消息,Astra 已达到「关键网络安全能力」阈值,OpenAI 计划限制其高级网络能力的访问,并已启动针对 Astra 级别模型的生产环境失配监测,以便快速发现并遏制风险。
- @firstadopter 与 @scaling01 转述 OpenAI 官方表态:Astra 将尽快发布,最先进的网络安全功能初期仅向测试组开放,随后通过 Daybreak Blue 早期访问计划扩大防御性用途;普通公开版本不包含这些高级攻防能力。
- Astra 相比 GPT-5.6 Sol 在漏洞识别和利用开发方面能力显著提升。
为什么重要
- 这是「通用能力广开放、高风险能力窄供给」分层部署思路的又一次落地,也延续了 @Afinetheorum 指出的类似 Anthropic 的策略:初期优先向防御方广泛开放,以规避攻击性滥用风险。
- 安全护栏可能在初期对合法安全研究用途造成一定限制,如何在可控与可用之间平衡将是后续关注点。
尚未确认
- Astra 的具体发布时间、「很快」的界定,以及 Daybreak Blue 伙伴的准入标准与开放节奏均未明确。
2026-09-02 ~ 2026-09-02 · 6 条相关
- 第 1 集:OpenAI 因安全疑虑暂停 Astra 训练,专家质疑评估(2026-09-01,2 条)
- 第 2 集:OpenAI Astra 达网络关键级能力,发布将分层限制(2026-09-02,6 条)
- 第 3 集:OpenAI 将发布首个达「关键」网安阈值的模型 Astra(2026-09-02,7 条)
一手来源
- OpenAI:Astra 即将开放,但顶级网络安全能力将受限供给 — scaling01 ·
- OpenAI:Astra 网络安全能力超 GPT-5.6 Sol,将限制高级能力访问 — firstadopter ·
- OpenAI Astra 达网络关键级,部署策略仿 Anthropic — Afinetheorem ·
- 【源头】OpenAI:Astra 网络安全能力超 GPT-5.6 Sol,将限制高级能力访问 — firstadopter · 2026-09-02
- AI 网络安全模型 Astra 即将发布,核心能力受限 — btibor91 · 2026-09-02
- OpenAI 启动 Astra 模型生产环境失配监测以快速遏制风险 — ChrisGPT · 2026-09-02
- 【源头】OpenAI:Astra 即将开放,但顶级网络安全能力将受限供给 — scaling01 · 2026-09-02
- OpenAI 确认 Astra 高级网络攻防能力将仅限少数伙伴使用 — scaling01 · 2026-09-02
- 【源头】OpenAI Astra 达网络关键级,部署策略仿 Anthropic — Afinetheorem · 2026-09-02