MinkowskiPE Encodes Spacetime Displacement for Attention, Cuts Video Prediction MSE 9.9%

Yuhao Li · hf · 2026-10-06

Minkowski Positional Encoding (MinkowskiPE) parameterizes Lorentz transformations on query/key features with joint spatiotemporal coordinates, making attention scores depend only on relative spacetime displacement between tokens — invariant to global translation while keeping the standard dot-product interface.

Original post →

More from Research

Research channel →