Brockman:OpenAI 用 Astra 自查安全漏洞直到「找不到为止」,25% 生产工程师转入防御
mimi10v3 · x · 2026-09-15
a16z 发布的访谈中,OpenAI 总裁 Greg Brockman 详述了用自家模型 Astra 做内部安全攻防的做法:
- 组织层面:抽调 25% 的生产工程师暂停原有项目,全部转入防御,专职升级安全架构,并用模型去找系统漏洞
- 成果:发现并修复了一批严重问题
- 饱和判据:新问题逐渐减少直至模型能力饱和——据其所知已找完 Astra 能找到的全部 P0 级问题;每次新模型发布都会开启新一轮循环
- 方法论:强调要保持在「网络攻防能力提升→再自查」的紧循环中
有网友(他人引用观点)进一步提议 OpenAI 应将形式化验证推广到关键开源基础设施。这条访谈是「AI 用于自身安全」最具体的一手案例之一。
所属事件:Greg Brockman 宣称已身处 AGI 时代,详解安全防御策略(4 条相关)→
「公司和人」频道最新
- Sarah Hooker:即使选择退出训练,实验室仍能利用你的 IP — sarahookr · 2026-09-15
- Modal 公布 Runtime 大会议程,涵盖基础设施与机器人 AI — charles_irl · 2026-09-15
- 黄仁勋:监管应对准前沿 AI 实验室的真实风险 — pstAsiatech · 2026-09-15
- 黄仁勋回击 Anthropic 安全预警:那不是基于科学的预测 — firstadopter · 2026-09-15
- Michael Burry 炮轰 OpenAI 与 Anthropic:末日论是 IPO 前戏 — ChunkyWaterMonkey · 2026-09-15
- OpenAI 员工长文拆解:ChatGPT、Codex 与新 Agents API 如何分工 — TheMoonMidas · 2026-09-15