Image-only DINOv2 and text-only Qwen3 converge on similar world geometry, new paper finds

lmoroney · x · 2026-10-10

A new paper, "Shared Geometry as a Rosetta Stone" by Dominik Schnaus et al. (TU Munich, MIT, ETH Zurich), shows that DINOv2 (trained only on images) and Qwen3 (trained only on text) have surprisingly similar internal representational geometry.

Related event: DINOv2 and Qwen3 embeddings aligned without any image-text pairs(4 posts)→

Original post →

More from Models

Models channel →