Microsoft Research: safety training on SLMs also improves privacy preservation

EchoShao8899 · x · 2026-09-20

Microsoft Research used the PrivacyLens benchmark as an OOD dataset in its MOSAIC paper and found an interesting transfer effect: training a small language model for safety automatically improved its privacy preservation. Safety and privacy capabilities appear positively correlated.

Original post →

More from Research

Research channel →