Beating AI Detectors Is a Terrible Proxy for Training Good Writing Models

viemccoy · x · 2026-08-20

The author argues that optimizing models to beat AI detectors like Pangram is misguided. This approach forces models to adversarially optimize against "good writing," degrading quality, especially since detectors were trained on older, better-writing models. True writing quality requires human assessment, not reliance on provenance detection metrics.

Related event: Critics warn AI detectors are a bad proxy for writing quality(2 posts)→

Original post →

More from Models

Models channel →