Strix Halo 128GB 双 GPU 同跑两模型遇 OOM,参数全公开

El_90 · reddit · 2026-09-14

作者在 Strix Halo 128GB(Vulkan1)上跑 Laguna-S 2.1 Q6(GTT 占用 107G/124G),同时通过 oculink 外接 r9700(Vulkan0)跑 Qwen3.8-27B Q6,单独运行都正常,但两模型同时加载即触发内核 OOM。

作者想知道除显存外还有什么系统资源会被 llama.cpp 耗尽,向社区求助。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →