3060+3080 跑 Qwen3.8 27B:26.8t/s 显存优化配置

Fieser_Fettsack · reddit · 2026-08-19

用户分享在旧 i7 8700 平台上,利用 RTX 3060 (12G) 和 3080 (10G) 双卡 RPC 集群运行 Qwen3.8-27B 的实测配置。通过 llama.cpp RPC 实现约 26.87 t/s 的解码速度和 299 t/s 的预填速度,并提供了详细的 Docker Compose 配置参数。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →