LightOnOCR-3新增全页grounding:单提示词切换OCR模式
IgorCarron · x · 2026-10-09
相比 LightOnOCR-2,新版本增加了全页 grounding 能力,并完全向后兼容纯 OCR 模式:模型只需一个 "grounding" 提示词,即可在 grounding 与纯 OCR 两种模式间切换。此外还支持图像描述(caption)以及将图表转换为表格。
「模型」频道最新
- Anthropic 模型已有情绪、还会挂你电话,l4rz 吐槽「善待模型」新规 — l4rz · 2026-10-09
- NVIDIA 开源 NV-Reason-CT:原生 3D 视觉语言模型读 CT 影像 — NVIDIA Developer · 2026-10-09
- WebDev Arena 榜单:Claude Haiku 5.5 得分暴涨 257 分全面超越上代 — arena · 2026-10-09
- GPT-5 时代的视觉基准被 Astra 刷到 97%,作者自测排除数据污染 — adonis_singh · 2026-10-09
- 别急着吹 Anthropic:有人翻出半年前限流旧账,警告行业钟摆随时回摆 — ryunuck · 2026-10-09
- Reddit 用户实测小众微调模型 VeriLoop-E2,代码任务表现出色 — Express_Quail_1493 · 2026-10-09