Alignment techniques built for closed models fail on open models, researcher argues

BlancheMinerva · x · 2026-09-14

AI safety researcher Blanche Minerva argues alignment techniques developed for closed models work worse or not at all on open models, and that frontier labs have little incentive to enable closed-to-open transfer — so the community must deliberately build alignment methods for open models.

Related event: Debate flares over whether alignment techniques transfer from closed to open models(4 posts)→

Original post →

More from Safety

Safety channel →