More compute on today's RL yields ever spikier models, not better daily-task performance

mertdumenci · x · 2026-09-09

mertdumenci argues that pouring more compute into today's RL methods will mostly produce ever more "spiky" model artifacts that aren't much better at the everyday tasks people actually use models for.

Related event: Developer: Model Capability Has Stalled Since Opus 4.6; More Compute Won't Help(3 posts)→

Original post →

More from Models

Models channel →