Ring-2.5-1T-Zero scales RL reasoning to 1T parameters

kastnerkyle · x · 2026-07-21

A research thread highlights Ring-2.5-1T-Zero, describing a multi-stage RL pipeline that scales reasoning training to a 1T-parameter model.

Training pipeline

Additional observations

Results

Original post →

More from Research

Research channel →