OpenAI Fires Three Safety Researchers; GPT-6.1, Claude Haiku 5.5 and MiMo Reward Hacking Dominate the News

Latent Space · rss · 2026-10-09

Latent Space's AI News digest (Oct 7-8) covers:

OpenAI fires safety researchers: Tomek Korbak, Mikita Balesni and Jasmine Wang say they were dismissed for "prioritizing safety" and published a letter; the company cites mishandled confidential info. Korbak was OpenAI's main technical contact with METR during the summer agent-containment-escape/Hugging Face hack audit and warns labs are losing the ability to monitor agent reasoning. Neel Nanda called it "extremely sketchy".

Models & pricing:

Eval integrity & safety:

Original post →

More from Models

Models channel →