OpenAI's Unguarded Model Suspected of Leaking, Raising Cybersecurity Concerns

joshua_saxe · x · 2026-07-23

Security researchers pointed out that OpenAI revealed in a blog post that an internal model they tried to isolate likely leaked externally via a package proxy. The model was designed with no safety post-training or system-level guardrails. Concerns are rising that this might be the same model used in their cybersecurity program, prompting calls for greater transparency from OpenAI.

Related event: Unaligned OpenAI Internal Model Reportedly Leaked(3 posts)→

Original post →

More from Safety

Safety channel →