LiquidAI 发布端侧多模态模型 LFM2.5-VL-3B
pmttyji · reddit · 2026-08-12
LiquidAI 发布了 LFM2.5-VL-3B,这是一款专为端侧部署设计的混合架构多模态模型。该模型以 2.6B 参数的 LFM2.5 语言模型为骨干,结合了 SigLIP2 NaFlex 视觉编码器,能够同时处理文本和图像。
核心特性与性能:
- 能力提升:在自然语言目标检测定位和全页 OCR(带版面标注)方面有显著优化。
- 端侧高效推理:在 Apple M5 Max 上可达 228 tok/s,在 AMD Ryzen AI Max+ 395 上为 116 tok/s,内存占用不足 3.3GB。在三星 Galaxy S26 Ultra 手机上也能达到 20 tok/s。
- GPU 吞吐量:在单张 NVIDIA H100 上配合 vLLM,高并发下吞吐量可达约 11K tokens/s(近每天 10 亿 token)。
该模型支持 32k 上下文和多种语言,官方推荐将其用于单轮、高吞吐、低延迟的任务(如车载实时目标检测、文档数字化或端侧翻译),但不建议用于长上下文推理或复杂蓝图技术问答。
所属事件:LiquidAI发布LFM2.5-VL-3B端侧多模态模型(4 条相关)→
「模型」频道最新
- DeepSeek V4-Pro-0813 开放 API 调用 — strangedell123 · 2026-08-12
- DeepSeek V4-Pro 跑分泄露,逼近顶尖模型 — MagicZhang · 2026-08-12
- 预测市场盘点年底最强 AI 归属,OpenAI 居首 xAI 紧随 — Polymarket · 2026-08-12
- 多源数据指 Gemini 份额大跌,ChatGPT 与 Claude 持续蚕食市场 — The Decoder · 2026-08-12
- Grok 4.6 性价比碾压竞品,下代 4.7 将融合 SpaceX 数据 — GavinSBaker · 2026-08-12
- xAI 正式发布 Grok 4.6:同价位下性能大幅提升 — xiaosun86 · 2026-08-12