LiquidAI 发布 3B 视觉模型,屏幕理解与 OCR 能力大幅提升
helloiamleonie · x · 2026-08-12
LiquidAI 推出轻量级视觉语言模型 LFM2.5-VL-3B,专注于读取屏幕、文档及物理世界信息。
该模型基于 LFM2.5-2.6B 基座与 SigLIP2 视觉编码器构建,在移动端、网页和桌面端的屏幕理解、文本图表读取及工具调用方面表现优异。官方数据显示,其性能可媲美甚至超越 2.6 倍体量的同类模型,在 ScreenSpot-v2、RealWorldQA 等基准测试中均取得高分。
所属事件:LiquidAI 发布端侧多模态模型 LFM2.5-VL-3B(7 条相关)→
「模型」频道最新
- 实测 Grok 4.6 修 Bug 能力:超越前代,成新默认模型 — PawelHuryn · 2026-08-13
- Grok 4.6在5美元预算下AI模型评测登顶,性价比突出 — XFreeze · 2026-08-13
- 长周期自主工作流:OpenAI 与 Anthropic 模型表现远超对手 — scaling01 · 2026-08-13
- Grok 4.6 智能体评测逼近 Claude Fable 5,单次任务成本仅其五分之一 — ArtificialAnlys · 2026-08-13
- DeepSeek V4 Pro 性价比曝光:单任务成本仅为 GLM5.2 十分之一 — ojasvi_yadav · 2026-08-13
- DeepSeek API 请求超时,疑似遭遇技术故障 — cedric_chee · 2026-08-13