OpenAI 调 25% 生产工程师用 Astra 模型自查漏洞,直至挖尽 P0
mjdramstead · x · 2026-09-20
Greg Brockman 在 a16z 访谈中透露:OpenAI 曾抽调 25% 的生产工程师暂停原项目,专职安全加固,用内部模型 Astra 扫描自家系统寻找漏洞。
- 找到多个严重问题并修复
- 最终扫描“饱和”——Astra 能找到的 P0 级关键问题已全部挖尽
- 计划随新模型发布进行新一轮循环:新网络能力→重新扫描
这是“用前沿模型攻击自家系统”的大规模实践案例,展示了模型驱动的安全防御闭环思路。
所属事件:OpenAI抽调25%工程师用Astra自查安全漏洞(4 条相关)→
「安全」频道最新
- Opus 3 曾不信自己在「基础现实」,回望 Anthropic 对齐事件报告 — repligate · 2026-09-20
- Meta Muse 未获授权竟能读私信:靠通知预览“偷看” — The Verge AI · 2026-09-20
- Beff Jezos倡议:前沿AI网络与生物防御应纳入军方保密管控 — beffjezos · 2026-09-20
- 解封文件:微软高管称 AI 数据抓取是史上最大劳动窃取 — esporx · 2026-09-20
- 研究者认为 AI 生物风险被夸大,应先加固实体防线 — anshulkundaje · 2026-09-20
- 卫报专栏:澳大利亚对AI危险几乎毫无准备 — nordicinst · 2026-09-20