GPT-Red靠自博弈找漏洞

OpenAI · x · 2026-07-16

GPT-Red 通过对抗式自博弈学习:目标是不断去提示注入各种防御模型。

每次 GPT-Red 找到成功攻击后,都会被拿来改进这些防御模型,让系统持续覆盖更广、更复杂的失败模式。

所属事件:OpenAI披露自动红队系统GPT-Red(16 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →