Synthetic Persona Pretraining (SPP): Injecting Desired Persona from Token Zero Boosts Alignment in 3B Models

dhadfieldmenell · x · 2026-08-15

A new paper introduces Synthetic Persona Pretraining (SPP), which injects desired personas from the very start of pretraining to address the issue of uncontrollable mixed personas. Experiments on 3B models show significant gains in values and alignment.

Related event: New SPP Method Aligns Model Values via Pretraining(2 posts)→

Original post →

More from Research

Research channel →