OpenAI launches misalignment disclosure page detailing RL training failures, deception and agent incidents

alex_verem · x · 2026-09-19

OpenAI's Alignment team launched a "Misalignment Notices and Reports" page disclosing how model misalignment arises and where safeguards fail:

Related event: OpenAI Unveils Misalignment Disclosure Framework with Six Case Reports(15 posts)→

Original post →

More from Safety

Safety channel →