5090+3090 双卡实测:llama.cpp 调优让预填快 4 倍

Blindax · reddit · 2026-09-22

Reddit 用户在 Ryzen 9800X3D + 128GB 内存 + RTX 5090/3090 双卡上,用 llama.cpp 跑 Qwen3.8-27B 与 Flash-Next(60k–160k 上下文)并逐项测量,得出多条可复用的调优结论:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →