LFM2.5 端侧评测登顶:2.32GB 内存、8 秒延迟,39 款小模型中并列第一
maximelabonne · x · 2026-09-22
Artificial Analysis 联合 Liquid AI 发布手机端小模型推理评测,在 iPhone 17 Pro 与 Galaxy S26 Ultra 上实测 39 款可装入 8GB 内存的模型。
- LFM2.5 家族 5 款模型中 4 款进入智能-内存-延迟联合 Pareto 前沿
- LFM2.5-2.6B 智能得分与 Nanbeige 3B 并列第一,超越 3-10 倍更大的模型,内存占用少约 40%,延迟低 3 倍
- iPhone 上峰值内存 2.32GB、端到端延迟 8.0s,对比 Nanbeige 的 4.03GB / 21.4s;Galaxy 上 2.45GB / 18.6s vs 4.13GB / 71.4s
- 是目前两款测试设备上 2.5GB 以下得分最高的模型
评测用 5 项基准(BFCL 子集、IFBench、AA-Omniscience、GPQA Diamond、MATH-500)平均,16K 上下文,端到端时间定义为处理 1024 token 提示并生成 256 token 回复的全程耗时。参评厂商包括 Nanbeige、Liquid AI、Ornith AI、阿里、Google、TII 等。
「Infra」频道最新
- NVIDIA 推出 DSX Ready 认证,为 AI 工厂预审电源与冷却产品 — nordicinst · 2026-09-22
- AMD 苏姿丰放话要突破 2006 年 25% 服务器芯片份额峰值 — firstadopter · 2026-09-22
- GitHub Actions 限流太烦,开发者自建 dsr 本地接管发布流程 — doodlestein · 2026-09-22
- SGLang 上线 NVFP4 4-bit KV Cache:长上下文解码提速最高 78% — BanghuaZ · 2026-09-22
- 开源后训练框架 Halo 发布:吞吐达 TRL 2.8 倍且更省显存 — _akhaliq · 2026-09-22
- OpenCV 推出企业版支持服务,年起价 15 万美元,开源版不变 — mrpollo · 2026-09-22