Hugging Face Kernels: Swap Faster Kernels Into Models Without Rewriting

RisingSayak · x · 2026-09-18

Hugging Face's Sayak Paul demos the 🤗 Kernels library, which lets you swap optimized kernels into supported model layers without rewriting the model. A decorator (usekernelforwardfromhub) marks layers as swappable, a mapping binds layers to Hub kernels per device, and kernelize(model, mode=Mode.INFERENCE) replaces forward() on eligible layers only. You can specify separate kernels for inference vs training and per device type, registered globally or locally.

Related event: Hugging Face Launches Kernels Library for Drop-in Faster Kernels(2 posts)→

Original post →

More from coding & agent

coding & agent channel →