Saral-Docling 开源:集成 YOLOv8 与 PP-OCRv6 的 PDF 解析工具
ponguru · x · 2026-08-12
Saral AI 团队开源了 Saral-Docling,一个高效的 PDF 文本与图表提取工具。
- 核心功能:结合 PyMuPDF 提取原生文本,使用内置的 YOLOv8 DocLayNet ONNX 模型检测并重绘图片与表格区域。
- OCR 能力:支持通过 PP-OCRv6 对扫描版 PDF 进行文字识别,模型体积仅约 35MB,支持 CPU 与 GPU 运行。
- 安装便捷:可通过 pip 一键安装,模型权重已打包在 wheel 包中,开箱即用。
「编程与Agent」频道最新
- EigenLabs 打造野外多智能体科研环境 — gajesh · 2026-08-12
- 开源参数化CAD应用SolidType:展示实时协同与AI集成 — tom_doerr · 2026-08-12
- 开源工具 3dsvg:一键将 SVG 转为交互式 3D 组件 — tom_doerr · 2026-08-12
- Vibe Coding 第一法则:能跑就别问为什么 — victor_explore · 2026-08-12
- 不要跟 AI 比聪明,驾驭它完成任务就好 — dotey · 2026-08-12
- AI 编程现状:4 小时狂写 5 万行,再花一天删到 2 千行 — dejavucoder · 2026-08-12