Stanford-Led Paper Trains Models From Scratch With Zero Real Data via Self-Play

Researchers from Stanford and others propose self-play pretraining with zero data: two randomly initialized models generate and learn from self-produced sequences, showing that general patterns can emerge without any real-world data.

2026-09-25 ~ 2026-09-26 · 2 related posts