smolbenchmark:按你的 8GB 硬件实测选出最合适的小模型
East-Muffin-6472 · reddit · 2026-09-12
- 主流模型排行榜默认服务器级 GPU,作者推出 smolbenchmark,专注能塞进 8GB 内存的模型,按解码速度、tokens/焦耳、发热排序。
- 覆盖平板、手机、Mac、Jetson、树莓派等设备,目前已有 13 个模型家族,Jetson nano Orin Super 8GB 上约 1,000 组配置;一台设备实时测量 tok/s、tok/J、ITL、延迟、功耗、温度与电池。
- 数据与详细报告全部公开,树莓派、手机和 Mac mini 的数据还在补充中,项目处于早期开发阶段征求反馈。
「Infra」频道最新
- 玻璃基板无加强筋翘曲改善超2倍,成AI封装新方向 — jwt0625 · 2026-09-12
- d-Matrix 携手 NVIDIA:Raptor XPU 接入 NVLink Fusion 机架级系统 — bookwormengr · 2026-09-12
- 300K 上下文也扛不住大代码库,本地长任务如何自动交接 — Developer-Y · 2026-09-12
- 经济学人:英伟达已成「AI 的中央银行」 — tolugenius · 2026-09-12
- 24GB M5 MacBook Air 离线跑 LLM,选哪个 MoE 够快够好 — itis_whatit-is · 2026-09-12
- 16GB 显存跑 Qwen3.8 27B:DFlash2 草稿模型实测 60 tok/s — pneuny · 2026-09-12