Artificial Analysis 发布手机端小模型基准测试
ArtificialAnlys · x · 2026-08-25
Artificial Analysis 与 Liquid AI 合作发布了针对手机端小模型的智能与推理基准测试。智能评测包含五项评估,旨在衡量小模型在函数调用、知识和推理方面的表现;推理基准则在真实手机上测量速度、延迟和内存使用。文章指出,小模型基准测试面临挑战:传统前沿评测无法有效区分小模型,且移动端推理栈尚不成熟。该测试使用 4 位或更小精度的量化模型构建,以反映真实运行环境。
所属事件:Artificial Analysis 发布手机端小模型智能与推理基准(8 条相关)→
「Infra」频道最新
- SpaceX 与 Nvidia 拟 2027 年发射太空 AI 超算 — Polymarket · 2026-08-25
- SemiAnalysis: AMD软件拉跨,Nvidia成本优势高达5倍 — rohanpaul_ai · 2026-08-25
- 研究称美国GDP统计低估Nvidia贡献,增长率少算0.3% — aidan_mclau · 2026-08-25
- 微软模型路由器:将模型选择视为反馈循环 — WirelessLife · 2026-08-25
- 通义 Qwen3.8-27B 跻身前沿模型行列 — wandb · 2026-08-25
- Mistral 携手沙特 HUMAIN,共建本地化前沿 AI 模型与基础设施 — MistralAI · 2026-08-25