面向 8GB 级设备的开源小模型榜单:SmolLM2-135M 达 165 tok/s、29.6 tok/J

East-Muffin-6472 · reddit · 2026-09-16

作者发布了 smolperfbenchmark,一个专门面向小型开源模型的本地性能榜单,补足主流榜单默认服务器级 GPU 的空白:所有模型用同一批 GGUF 文件、统一 llama.cpp vs Ollama 对比、锁定功耗模式并记录发热。

首个实测数据点:在 8GB Jetson Orin Nano Super 上,SmolLM2-135M 跑出约 165 tok/s、25W 下 29.6 tok/J。

目前状态:

全部测试数据将公开,供用户按自己的硬件挑选合适的模型。作者附了网站文章与 Reddit 帖链接,欢迎反馈。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →