笔记本+eGPU 跑本地推理

jupiterbjy · reddit · 2026-07-19

作者分享了一种“穷人版”移动本地推理方案:在笔记本上折腾 llama.cpp 参数,用有限硬件跑 Qwen3.6 30B A3B。

帖子里提到的体验点包括:

整体上这是一个很典型的本地部署 / 端侧推理折腾帖,重点在工程实践而不是模型本身。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →