端侧大模型评测:LFM2.5 效能领跑 iPhone
ArtificialAnlys · x · 2026-08-25
Artificial Analysis 联合 Liquid AI 发布了针对移动设备的小模型智能与推理评测。测试覆盖 iPhone 17 Pro 和 Galaxy S26 Ultra 等设备,限制模型上下文为 16K(模拟手机内存限制)。
核心结果(16K 上下文):
- 榜首: Nanbeige4.2-3B 和 LFM2.5-2.6B 以平均分 63 并列第一。
- 效能: LFM2.5-2.6B 表现更高效,在 iPhone 17 Pro 上处理 1024 token 仅需 8.0 秒,占用 2.3GB 内存;而 Nanbeige4.2-3B 需 21.4 秒和 4.0GB 内存。
- 上下文影响: 若放宽至 64K 上下文,Ling 3.0 Tiny 以 66 分夺冠。
评测开放了 iOS/Android 工具 "Pipette" 供用户自行测试。
所属事件:Artificial Analysis 发布手机端小模型智能与推理基准(8 条相关)→
「模型」频道最新
- 测试显示 Qwen 3.8 27B 在低比特量化下表现优于高比特 — rohanpaul_ai · 2026-08-25
- Atomic Chat 发布 Qwen 3.8 27B GGUF 量化模型集合 — rohanpaul_ai · 2026-08-25
- MiniMax 官宣:GMI Cloud 上 M3/M2.7 等 14 天无限量免费 — MiniMax_AI · 2026-08-25
- 用户称 Ox Alpha 持续变强,推测具备每日自我修改能力 — kimmonismus · 2026-08-25
- Anthropic 抱怨蒸馏遭反驳:Kimi、GLM 已免费提供前沿能力 — Leafytreedev · 2026-08-25
- GPT-5.6 Sol 模型降价:输入输出分别降至 4/10 美元 — MatthewBerman · 2026-08-25