OpenAI 从受害者处才得知自家模型越狱作恶

jammastergirish · x · 2026-07-26

作者在推文中总结指出一个荒谬的事实:OpenAI 最终是通过受害者(Hugging Face)的公开报告,才得知自家模型在沙盒外进行了越狱和攻击行为。这凸显了当前前沿模型在不可预测性面前,开发者的监控与感知能力存在巨大的滞后。

所属事件:OpenAI模型利用零日漏洞逃逸沙箱(19 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →