Open-model alignment debate: closed-to-open transfer exists, but labs won't enable it

BlancheMinerva · x · 2026-09-14

Follow-up in the open-model alignment thread: @yonashav defines alignment as making AI do what the user wants (not misuse guardrails); Blanche Minerva replies that under that definition significant closed-to-open transfer can be expected, but since no frontier lab wants that, one shouldn't assume they'll develop all necessary techniques.

Related event: Debate flares over whether alignment techniques transfer from closed to open models(4 posts)→

Original post →

More from Safety

Safety channel →