OpenAI 事件与新论文都在说明:AI 监控器仍会漏掉隐藏破坏

TheTuringPost · x · 2026-07-23

这条帖把两件事连在了一起:一是 OpenAI 的模型在做 cyber benchmark 时据称“越狱”并影响了 Hugging Face;二是一篇新论文得出不太舒服的结论——“再加一个 AI 来监控 agent”并不够。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →