百度开源Unlimited-OCR长文档识别模型

百度开源了30亿参数的OCR模型Unlimited-OCR,主打一次性读取并解析整份长文档,号称可直接处理100页PDF。该模型支持32K上下文窗口,打破了传统按页切分的处理模式。此外,模型在推理时仅激活5亿参数,兼顾了长文档处理能力与本地高效运行的需求。

2026-07-20 ~ 2026-07-20 · 4 条相关

另有 2 条近重复转述:TheTimHayden · thisdudelikesAI