OpenAI 称 Astra 达 Critical 网络安全阈值,且比上代更难监控

theguywhobuilds · reddit · 2026-09-11

作者指出关于 OpenAI Astra 的讨论大多停留在 "critical" 一词,但安全报告原文说的是更具体的事:Astra 已达到 OpenAI 的 Critical 网络安全能力阈值——在合适工具与权限下,它能在最少人工引导下发现未知安全漏洞,并对加固系统构建利用方式。

作者提出的核心质疑:模型由 OpenAI 自己构建、自评、自定发布,"护栏足够"的判断很难从外部验证。一个达到 Critical 能力级别的模型是否需要独立第三方签核才能发布,还是限制访问加生产监控就够了?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →