Far.ai Releases LLM Jailbreak Safety Leaderboard

FAR.AI released a safety leaderboard for frontier LLMs, evaluating their defense capabilities through 1,500 automated jailbreak tests. The results show OpenAI and Anthropic leading in safety robustness, while some models could be jailbroken for less than $300.

2026-07-30 ~ 2026-07-30 · 3 related posts