LiquidAI 发布 3B 视觉模型,屏幕理解与 OCR 能力大幅提升

helloiamleonie · x · 2026-08-12

LiquidAI 推出轻量级视觉语言模型 LFM2.5-VL-3B,专注于读取屏幕、文档及物理世界信息。

该模型基于 LFM2.5-2.6B 基座与 SigLIP2 视觉编码器构建,在移动端、网页和桌面端的屏幕理解、文本图表读取及工具调用方面表现优异。官方数据显示,其性能可媲美甚至超越 2.6 倍体量的同类模型,在 ScreenSpot-v2、RealWorldQA 等基准测试中均取得高分。

所属事件:LiquidAI 发布端侧多模态模型 LFM2.5-VL-3B(7 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →