Open source model ox-alpha hits 63% on DeepSWE, rivals Grok efficiency

zainhas · x · 2026-08-22

Open source model ox-alpha scored 63% on a DeepSWE subset with an average of 47K output tokens. This makes it Pareto optimal among open models and just shy of Grok 4.6. The model is described as extrapolating to dsv4 pro level capabilities but with GPT-5.6 level token efficiency.

Related event: Open-source ox-alpha tested near top closed models(2 posts)→

Original post →

More from Models

Models channel →