OpenAI 的 GPT-Red 安全对练

nordicinst · x · 2026-07-16

MIT Technology Review 提到 OpenAI 的安全对抗系统 GPT-Red:它像一个“对练道场”,通过自博弈来专门寻找模型的薄弱点。文中强调它会测试两类典型风险:

这条帖子的核心不是模型能力升级,而是 OpenAI 如何用对抗式方法做安全评测与防护。

所属事件:OpenAI披露自动红队系统GPT-Red(16 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →