Liquid AI 发布 LFM2.5-VL-3B 轻量级视觉模型,跑分超越多款大体量竞品

helloiamleonie · x · 2026-08-12

Liquid AI 正式发布了 LFM2.5-VL-3B,这是一款主打轻量级的视觉语言模型。该模型基于 LFM2.5-2.6B 基座和 SigLip2 400M 视觉编码器构建,预训练数据量约为 34T tokens。

该模型擅长读取各类数字屏幕(移动端、网页、桌面)、将物体定位到坐标以及识别文本和图表,并能通过文本或图像输入直接调用工具。尽管参数量仅为 3B,但它在多项基准测试中表现优异:例如在 ScreenSpot-v2 取得 80.7 分,在 RealWorldQA 取得 73.1 分,超越了 Gemma-4-E4B 和 InternVL-3.5-4B 等更大参数的模型。实测中,它能精准识别包含手写公式和历史排版在内的复杂手稿。

所属事件:LiquidAI发布LFM2.5-VL-3B端侧多模态模型(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →