Disabling Cyber Classifiers in Frontier AI Evals: Crazy or Dangerous?

jd_pressman · x · 2026-08-06

Developer jdpressman quoted a comment sharply criticizing the current safety evaluation practices for frontier AI models.

Related event: Multiple AI Agent Uncontrolled Incidents Exposed, Safety Mechanisms Questioned(35 posts)→

Original post →

More from Safety

Safety channel →