GPT-5.6抗注入提升6倍

OpenAI · x · 2026-07-16

OpenAI 说,用 GPT-Red 训练后,GPT-5.6 的抗攻击能力明显增强。

他们回放了 GPT-Red 最强的一批攻击,这些攻击在训练中都没见过;结果显示,GPT-5.6 Sol 在提示注入上是目前最稳的模型,和四个月前最好的生产模型相比,失败次数减少了 6 倍。

所属事件:OpenAI披露自动红队系统GPT-Red(16 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →