百美元级 Celeron 单板机实测:0.6B 模型还能用

tre7744 · reddit · 2026-07-24

一位 Reddit 用户在一台 Celeron N5095 单板机上做了 CPU-only 本地推理测试,结果显示:0.6B 模型已经能用,8B 则基本太慢。

测试平台是 Youyeetoo X1S:N5095(4C/4T、15W)、16GB 内存、128GB NVMe,使用 Ollama 跑 6 个模型。结果包括:

作者的结论是:低功耗 x86 机器上,小模型很适合分类、路由、摘要等后台任务;而 8B 规模会很快撞上内存带宽瓶颈。接下来他还准备测试 llama.cpp + Vulkan 的核显推理。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →