LiquidAI 发布 LFM2.5-VL-3B:端侧跑通多模态工具调用
helloiamleonie · x · 2026-08-13
LiquidAI 正式发布轻量级视觉语言模型 LFM2.5-VL-3B。该模型基于 LFM2.5-2.6B 基座与 SigLIP2 视觉编码器构建,能够读取屏幕、文档和物理世界,并支持从文本或图像输入直接调用工具。
性能亮点:
- 在 ScreenSpot-v2 测试中达 80.7 分,超越 Gemma-4-E4B。
- RealWorldQA 得分 73.1,优于 InternVL-3.5-4B。
有开发者在 M3 Pro 18GB 设备上进行了本地实测,模型成功识别英式早餐图片并通过工具调用搜索了菜谱,展现了优秀的 UI 理解、OCR 及工具调用能力。
所属事件:LiquidAI发布端侧视觉模型LFM2.5-VL-3B(10 条相关)→
「模型」频道最新
- 前沿模型变「不说人话」?是变聪明还是能力退化了 — MikeBirdTech · 2026-08-13
- Grok 4.6 在 MC 编程测试中表现优异,仅用两轮建好金门大桥 — Aizkmusic · 2026-08-13
- RTX 5080 实测:Qwen3.6 与 Muse Glimmer 本地生成体素世界对比 — myanimal22 · 2026-08-13
- DeepSeek 新旧版本对比:进步明显,但仍缺乏手柄形态直觉 — teortaxesTex · 2026-08-13
- 基于 Nemotron 3.5 微调,Juno-N-Coder-25B 发布 — NVIDIAAI · 2026-08-13
- Nemotron 3.5 Lightning 实测:企业级吞吐量达 Gemma 4 的 5 倍 — NVIDIAAI · 2026-08-13