LiteParse 升级:无需视觉模型即可精准提取 PDF 复杂结构

llama_index · x · 2026-08-03

LlamaIndex 宣布其文档解析工具 LiteParse 迎来重要升级,现在能够直接从 PDF 中提取丰富的结构化数据。

新功能支持提取表单字段值、复选框状态、注释、嵌入图像、矢量图形以及单词级别的边界框,且处理速度极快(毫秒/页)。对于确实需要调用视觉模型的复杂页面,LiteParse 引入了新的复杂度信号机制,能够识别扫描页、多栏文本、表格和密集图表,从而帮助开发者将复杂的解析任务精准路由给最合适的工具(如 LlamaParse)。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →