百度开源Unlimited-OCR长文档解析模型

百度近期开源了Unlimited-OCR模型,引发了包括Yann LeCun在内的业界关注。该模型总参数约30亿,推理时仅激活5亿参数。其核心亮点是采用了Reference Sliding Window Attention(R-SWA)机制,摆脱了传统OCR的长度限制,能够一次性连续解析并读完数十甚至40页的长文档,大幅提升了文档处理的效率与连贯性。

2026-07-22 ~ 2026-07-24 · 3 条相关

另有 1 条近重复转述:vista8