AUR llama.cpp-cuda 包被删后性能暴跌 90%,网友自行编译找回
MrHall · reddit · 2026-09-08
- Reddit 用户发现 AUR 上的 llama.cpp-cuda 包被删除后,改用注释中推荐的 ggml-cuda + llama.cpp 组合(v3 优化版 CachyOS 构建),性能暴跌到原来的约 10%。
- 现象是:模型能完整载入 GPU,但计算似乎全落在 CPU 上。
- 作者找到旧 PKGBUILD 用其编译脚本重新构建,同时启用最新 CUDA 优化(针对 RTX 5070)和 CPU 优化,预填充速度从 150 t/s 恢复到 1800 t/s。
- 帖子困惑于为何官方二进制包与自编译差距如此之大,以及是否有额外的依赖包遗漏;同时抱怨 llama.cpp 更新太频繁、不想每天手动克隆编译。
「Infra」频道最新
- FT: CXMT 与长存已囤足三年扩产所需 ASML DUV 光刻机 — basedjensen · 2026-09-08
- 英伟达单季净利 597 亿美元,超过 12 家标志性公司总和 — FinanceYF5 · 2026-09-08
- 四个小模型合并进一台推理服务器,doc-QA agent 运维负担大减 — Sad-Razzmatazz-7657 · 2026-09-08
- 华为昇腾登台 PyTorch 中国大会:从硬件适配走向联合标准研究 — PyTorch · 2026-09-08
- UHP 激光器系列第三篇:MOPA 方案对比 Lumentum 路线 — vikramskr · 2026-09-08
- 江波龙港股上市募资70.8亿港元,半年净利105亿暴涨7万倍 — 创业邦 · 2026-09-08