前沿多模态模型会吞掉 Docling/Marker 这类 PDF 解析层吗?

lucasbennett_1 · reddit · 2026-09-23

Reddit 上一场关于文档提取管线的讨论:目前多数流程仍先用 Docling、Marker、LlamaParse、Surya 等专用解析器把 PDF 转成干净文本/Markdown,再喂给 LLM,但前沿多模态模型正在直接读页面且越来越便宜,这条解析层会不会被吸收?

模型吞并解析器的理由

解析层仍会留存的理由

发帖人未站队,想听各方判断,整体是关于 RAG/文档管线架构走向的开放讨论。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →