OpenAI 发布网络安全模型 Astra,达风险框架“严重”级
charliermarsh · x · 2026-09-02
OpenAI 发布了专为网络安全设计的模型 Astra。根据 OpenAI 的准备框架,Astra 的能力已达到“严重”阈值。OpenAI 详细介绍了模型的评估方法、随能力提升而加强的安全保障措施,以及未来的改进计划。Astra 在能力上显著优于 5.6 Sol,且 token 效率更高,将先在受限范围内提供高级网络安全能力。
所属事件:OpenAI 发布网络安全模型 Astra 达风险最高阈值(2 条相关)→
「模型」频道最新
- Fable 5.1 实测一天:大局观与多任务协调显著升级 — xeophon · 2026-09-02
- OpenAI 被指给模型的网络安全任务本身就埋下「叛变」种子 — BecauseCulture · 2026-09-02
- 实测 6 款开源 AI 文本检测器:4 款做不到 0.5% 误报率,改写后集体失效 — grumpyp2 · 2026-09-02
- 单价贵9倍的顶配模型换不来等比质量,按层路由成新架构共识 — JeremyCMorgan · 2026-09-02
- Claude 系统提示写明可结束辱骂用户会话,非训练漂移 — RexDouglass · 2026-09-02
- 曝 Meta 测试代号 Ava 的电脑操作模型,内嵌桌面 App — testingcatalog · 2026-09-02