折腾矿卡:CMP 170HX 运行 llama.cpp 提速 50% 实测

fragment_me · reddit · 2026-08-14

一位开发者分享了使用两张解锁后的 CMP 170HX 矿卡(65GB)运行 llama.cpp 的性能调优经验。

通过强制开启 GGMLCUDAFORCECUBLAS,在运行 Qwen 3.6 27B 模型时,其 Prompt 处理速度从每秒 1000 token 提升至 1500 token,提升幅度约 50%。不过作者指出,即便提速,该卡的整体速度仍不及 RTX 3090。

所属事件:实测CMP170HX矿卡:256GB显存高效运行大模型(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →