百度发布Unlimited-OCR视觉模型
baidu · hf · 2026-07-05
百度在 Hugging Face 发布 Unlimited-OCR,一个多语言视觉语言 OCR 模型,基于 image-text-to-text 流程,提供特征提取与图文理解能力,权重以 safetensors 提供。
「多模态」频道最新
- 有人在问 Video2X 能否加载 OpenModelDB 自定义模型 — Used-Profit2355 · 2026-07-27
- 有人想让 AI 逆向拆解爆款视频特效成 ComfyUI 流程 — stale2000 · 2026-07-27
- Midjourney V8.2 加入个性化并展示新图像效果 — Mr_AllenT · 2026-07-27
- Midjourney 图像多样性引发 Krea 2 对比与复现提问 — diffusion_throwaway · 2026-07-27
- AI 短片把 1985 年反乌托邦拍成电影感作品 — ProfessorKey98 · 2026-07-27
- Google Omni 做出的 BOTPD 新集变成追车戏仿 — ScriptLurker · 2026-07-27