Jina AI's jina-ocr-v1 document understanding model trends on Hugging Face

jinaai · hf · 2026-09-19

jina-ocr-v1 from Jina AI is trending on Hugging Face. The image-text-to-text multimodal model (built on deepseekvlv2) targets OCR, multilingual document intelligence, and vision-language understanding, shipped with transformers and safetensors support for document parsing workflows.

Related event: Tencent's WeVisDoc and Jina AI's jina-ocr-v1 Launch Same Day, Topping OCR Benchmarks(6 posts)→

Original post →

More from Multimodal

Multimodal channel →