Liquid AI 发布 3B 视觉语言模型,跑分超越 2.6 倍体积竞品
JosephJacks_ · x · 2026-08-13
Liquid AI 推出轻量级视觉语言模型 LFM2.5-VL-3B。该模型基于 LFM2.5-2.6B 基座与 SigLIP2 视觉编码器构建,预训练数据量达 34T tokens。
模型主打跨平台(移动端、网页、桌面)的屏幕阅读、文档解析与物理世界理解能力,支持文本与图像输入的工具调用。跑分方面,它在多项基准测试中表现优异:
- ScreenSpot-v2 得分 80.7(优于 Gemma-4-E4B 的 51.2)
- RealWorldQA 得分 73.1(优于 InternVL-3.5-4B 的 67.7)
- TextVQA 得分 84.3(优于 Qwen3.5-4B 的 81.2)
整体性能达到甚至超过其 2.6 倍参数量的同类模型,适合作为端侧应用的基础模型进行二次开发。
所属事件:LiquidAI 发布端侧多模态模型 LFM2.5-VL-3B(7 条相关)→
「模型」频道最新
- DeepSeek V4 Pro 被指在 Agentic Coding 中易早停 — karminski3 · 2026-08-13
- 实测 Grok 4.6 修 Bug 能力:超越前代,成新默认模型 — PawelHuryn · 2026-08-13
- Grok 4.6在5美元预算下AI模型评测登顶,性价比突出 — XFreeze · 2026-08-13
- 长周期自主工作流:OpenAI 与 Anthropic 模型表现远超对手 — scaling01 · 2026-08-13
- Grok 4.6 智能体评测逼近 Claude Fable 5,单次任务成本仅其五分之一 — ArtificialAnlys · 2026-08-13
- DeepSeek V4 Pro 性价比曝光:单任务成本仅为 GLM5.2 十分之一 — ojasvi_yadav · 2026-08-13