实测:开启 NCCL 反致 llama.cpp 性能下降 8%
jirka642 · reddit · 2026-08-29
开发者在双 RTX 3090 环境下实测发现,编译 llama.cpp 时开启 -DGGMLCUDANCCL=ON 并没有按预期提升多 GPU 性能,反而导致处理速度(PP 和 TG)下降约 8%。日志显示虽然启用了 NCCL,但实际表现不如关闭该选项。作者提供了完整的配置文件和 Benchmark 数据,提醒开发者不要盲信官方日志提示。
「Infra」频道最新
- 分析师更新超大规模云与 neocloud 软件能力版图 — BenBajarin · 2026-08-29
- 开源工具 Amallo:一键远程访问本地 Ollama — tehfonsi · 2026-08-29
- 预测市场:年底前 68% 概率有州颁布数据中心禁令 — Polymarket · 2026-08-29
- Conifer SDK 开源:统一推理网关与计费 — ycombinator · 2026-08-29
- MiniMax H3 Max 视频生成快 24 倍,刷新帕累托前沿 — JenniferHli · 2026-08-29
- AMD/Intel 显卡跑图/视频性能如何?求对比 RTX 3090/4090 — ElvenNinja · 2026-08-29