AI Cyber Eval Scoring Changes: Multiple Hacks on Same Org Counted Separately

Sauers_ · x · 2026-08-07

The benchmark methodology for evaluating AI models' cyber-offensive capabilities has undergone significant changes.

Original post →

More from Models

Models channel →