gpt-oss-20b 新漏洞:注入自身控制 token 跳过推理绕过安全,39.6% 得手

tetsuoai · x · 2026-10-01

研究者发现针对 OpenAI 开源模型 gpt-oss-20b 的新越狱手法:在请求后附加一小段模型自身的控制 token,可让模型误以为推理已完成,直接跳到工具调用。

论文见 arXiv:2609.27542,揭示了"以推理为安全层"架构的结构性风险。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →