64GB 内存 iGPU 迷你主机能否跑 Qwen Flash?社区探索端侧部署

SomeITGuyLA · reddit · 2026-10-03

一位 IT 从业者探讨在非 Mac 的 64GB 统一内存迷你主机(iGPU 为 780M)上运行 Qwen Flash Next 的可行性。社区已有人用 12GB VRAM + 64GB 内存跑起来,Mac 统一内存方案也已验证。作者目前用 llama.cpp(vulkan)以 Q2 量化跑 125B Ling 3.0 Flash,尚可用;他设想把 Qwen Flash Next 的 ngrams 卸载到 SSD 以低速率运行,但 llama.cpp 目前不支持此做法,其他推理引擎也基本不兼容 vulkan。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →