Jina AI 发布 jina-ocr-v1 文档理解模型,冲上 Hugging Face 热榜
jinaai · hf · 2026-09-19
Jina AI 的 jina-ocr-v1 模型登上 Hugging Face 热门榜。该模型为 image-text-to-text 多模态架构(基于 deepseekvlv2),主打 OCR、多语言文档智能与视觉语言理解,支持 transformers 与 safetensors,可用于文档解析与特征提取等场景。
所属事件:腾讯 WeVisDoc 与 Jina jina-ocr-v1 同日上线,冲击 OCR 榜首(6 条相关)→
「多模态」频道最新
- 阿里发布 Qwen3.8-LiveTranslate:实时同传延迟降至 2.3 秒 — xiaohu · 2026-09-19
- 阿里发布 Qwen3.8-LiveTranslate:实时语音翻译延迟从 2.8 秒降至 2.3 秒 — xiaohu · 2026-09-19
- 全开源 Diffusion Studio 生成发布视频,一条时间轴未手动剪 — _AustinCalvert_ · 2026-09-19
- 博主预测:过半 AI 视频将由代码渲染生成,而非纯扩散模型 — _AustinCalvert_ · 2026-09-19
- 网友实测 GPT 图像模型:70s 科幻风格九宫格出图质感惊艳 — aziz4ai · 2026-09-19
- Codex 内置 Images 2.5:先用图像模型重设计页面再实现 — OpenAIDevs · 2026-09-19