FAR.AI Leaderboard: OpenAI and Anthropic Models Outperform Gemini and Grok in Jailbreak Robustness

S_OhEigeartaigh · x · 2026-07-30

AI safety research organization FAR.AI has published a new leaderboard and study evaluating the relative difficulty of jailbreaking frontier language models, revealing significant disparities in robustness.

Related event: Far.ai Releases LLM Jailbreak Safety Leaderboard(3 posts)→

Original post →

More from Models

Models channel →