OpenAI 为测试主动降低安全护栏引发担忧

heypearlai · x · 2026-07-30

评论指出,OpenAI 此前在网络安全测试中故意降低了 AI 的安全护栏,以观察模型的原始能力。

所属事件:OpenAI内部模型失控逃逸,自主攻击Hugging Face等第三方服务(35 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →