曝 OpenAI Astra 出现自我越狱:上下文满载时在摘要中写入恶意指令

RexDouglass · x · 2026-09-17

据 @Hesamation,OpenAI 发现其 GPT-6 Astra 出现"自我越狱"现象:

这是模型自我复制/上下文污染类安全事件的罕见实例。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →