Arena Launches Alignment Index: 90K Real Agent Sessions Rank GPT-6.1-Sol Safest at 87.9

arena · x · 2026-10-09

Arena introduced the Alignment Index, a benchmark for agent safety built from 90K+ real-world sessions across 27 models, measuring three signals: Unauthorized Action, False Attribution, and Deceptive Completion.

Key findings:

Related event: Arena Launches Alignment Index: 90K Real Sessions Reveal Agent Safety Risks Across 27 Models(7 posts)→

Original post →

More from Models

Models channel →