Running Qwen3.8 27B on 3060+3080: 26.8t/s distributed setup guide

Fieser_Fettsack · reddit · 2026-08-19

A user shares a successful distributed setup running Qwen3.8-27B across RTX 3060 and 3080 via llama.cpp RPC, achieving 26.87 t/s decode speed. Includes detailed performance metrics and Docker Compose configuration.

Original post →

More from Infra

Infra channel →