GPT-5.6 强化了注入防护

Moh1tAgarwal · x · 2026-07-16

GPT-5.6 系列被称为对 prompt injection 非常鲁棒,即使在长而复杂的任务中,也能抵抗多种攻击类型。

为实现这一点,团队训练了一个名为 GPT-Red 的全自动红队系统,并采用了一种新的 self-play 方法来生成攻击与对抗样本。

所属事件:OpenAI披露自动红队系统GPT-Red(16 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →