百美元级 Celeron 单板机实测:0.6B 模型还能用
tre7744 · reddit · 2026-07-24
一位 Reddit 用户在一台 Celeron N5095 单板机上做了 CPU-only 本地推理测试,结果显示:0.6B 模型已经能用,8B 则基本太慢。
测试平台是 Youyeetoo X1S:N5095(4C/4T、15W)、16GB 内存、128GB NVMe,使用 Ollama 跑 6 个模型。结果包括:
- Qwen3 0.6B 平均 6.788 tok/s,交互上可用
- 8B 模型虽然能装进 16GB 内存,但只有 0.924 tok/s,实际很难用
- 连续 15 分钟全核压力测试,平均 74.66°C、峰值 77°C,没有降频
作者的结论是:低功耗 x86 机器上,小模型很适合分类、路由、摘要等后台任务;而 8B 规模会很快撞上内存带宽瓶颈。接下来他还准备测试 llama.cpp + Vulkan 的核显推理。
「Infra」频道最新
- Gemini CLI 通过强制 HTTPS 阻断凭据明文泄漏 — amelidev · 2026-07-24
- AMD Ryzen AI Halo 主打本地 AI 开发,统一内存达 128GB — ryanshrout · 2026-07-24
- 有人想要一层可按需启停的本地模型 API — minaminotenmangu · 2026-07-24
- Baseten 联合 CapitalG 办 Demo Night,讨论自建推理栈 — baseten · 2026-07-24
- AMD 称 MI350P 在企业工作负载上可提升 2–5 倍性价比 — ryanshrout · 2026-07-24
- Databricks Genie 以 MCP 接入 LangGraph,并部署到 Azure ML — Cautious-Meringue554 · 2026-07-24