Liquid AI 发布 LFM2.5-VL-3B 轻量级视觉模型,跑分超越多款大体量竞品
helloiamleonie · x · 2026-08-12
Liquid AI 正式发布了 LFM2.5-VL-3B,这是一款主打轻量级的视觉语言模型。该模型基于 LFM2.5-2.6B 基座和 SigLip2 400M 视觉编码器构建,预训练数据量约为 34T tokens。
该模型擅长读取各类数字屏幕(移动端、网页、桌面)、将物体定位到坐标以及识别文本和图表,并能通过文本或图像输入直接调用工具。尽管参数量仅为 3B,但它在多项基准测试中表现优异:例如在 ScreenSpot-v2 取得 80.7 分,在 RealWorldQA 取得 73.1 分,超越了 Gemma-4-E4B 和 InternVL-3.5-4B 等更大参数的模型。实测中,它能精准识别包含手写公式和历史排版在内的复杂手稿。
所属事件:LiquidAI发布LFM2.5-VL-3B端侧多模态模型(4 条相关)→
「模型」频道最新
- Kimi K3 开源策略被赞:以开源权重逼近 Anthropic 利润率 — willccbb · 2026-08-13
- 体积暴降 91%!Unsloth 实现 Qwen3.8 本地运行 — danielhanchen · 2026-08-13
- DeepSeek v4 Pro 评测引争议:实验室挑分基准难辨真实力 — kristoph · 2026-08-13
- 实测:GPT-5.6 Sol 执行子智能体比 Opus 5 更快 — brandon_galang · 2026-08-13
- Grok 4.6 上线 API:输入每百万 token 仅 2 美元 — XFreeze · 2026-08-13
- 微软首发自研推理模型 MAI-Thinking-1 — mustafasuleyman · 2026-08-13