Greg Brockman:OpenAI 调 25% 产研工程师用 AI 找漏洞直至枯竭
basedjensen · x · 2026-09-15
OpenAI 总裁 Greg Brockman 分享了公司用内部安全模型 Astra 强化自身防御的做法:
- 抽调 25% 的生产工程师暂停原项目,专职转向安全防御与安全架构升级,用模型系统性挖掘漏洞。
- 首轮即发现多个严重问题并修复;随着迭代推进,新发现逐渐枯竭——「据我们所知,Astra 能找到的所有 P0 与严重问题已全部找到」。
- 他主张防御方应进入「新模型能力出现 → 再跑一轮挖掘 → 再修复」的紧循环:如果当今最强模型都找不到你系统的新漏洞,那对 AI 加持的攻击者而言你也处于相当安全的位置。
转发者 @xlr8harder 认同这一观点,认为 AI 长期利好防御方,且每代新模型都可用同样流程复检。
「漫话AGI」频道最新
- Stuart Russell 撰文:AI 安全靠减速时间表救不了,须设硬性安全目标 — nordicinst · 2026-09-15
- 十年末日警告为何没拦住 AI 竞赛:卫报复盘行业分裂史 — nordicinst · 2026-09-15
- 被问 AI 会否十年内杀死人类,Dario Amodei 的回答被解读为「是」 — zetalyrae · 2026-09-15
- scaling 撞不撞墙不重要:距离平台期还有 3-4 个数量级 — willcb · 2026-09-15
- davidmanheim:我们尚不知如何「驾驭」AI,前沿公司押注日后补救 — davidmanheim · 2026-09-15
- 对齐研究者:弱对齐强 AI 若被广泛采用将是灾难 — davidmanheim · 2026-09-15