LiquidAI 发布 3B 轻量级视觉语言模型,多项跑分越级胜出
JosephJacks_ · x · 2026-08-13
LiquidAI 发布了全新的轻量级视觉语言模型 LFM2.5-VL-3B。该模型基于 LFM2.5-2.6B 和 SigLIP2 400M 视觉编码器构建,预训练数据量约 34T tokens,主打快速指令执行、出色的目标定位(grounding)和 OCR 能力。
官方数据显示,尽管参数量仅为 3B,但其表现可与 2.6 倍体量的模型相媲美甚至更优:
- ScreenSpot-v2 得分 80.7(优于 Gemma-4-E4B 的 51.2)
- RealWorldQA 得分 73.1(优于 InternVL-3.5-4B 的 67.7)
- TextVQA 得分 84.3(优于 Qwen3.5-4B 的 81.2)
目前模型已上线 Hugging Face,并支持通过 WebGPU 在浏览器内直接体验。
所属事件:LiquidAI 发布端侧多模态模型 LFM2.5-VL-3B(7 条相关)→
「模型」频道最新
- Grok 4.6 发布引争议,被指缺乏详细模型卡与安全测试 — Miles_Brundage · 2026-08-13
- 英伟达祝贺 xAI 发布 Grok 4.6:基于 GB300 训练 — elonmusk · 2026-08-13
- 网传 DeepSeek V4 Pro 正式版发布 — DevDminGod · 2026-08-13
- Grok 4.6 智能指数达 61,跻身大模型第一梯队 — elonmusk · 2026-08-13
- Upstage Solar Pro 4 评测:智商居前但速度过慢 — ArtificialAnlys · 2026-08-13
- Solar Pro 4 幻觉率下降真相:靠拒答而非知识增长 — ArtificialAnlys · 2026-08-13