Reddit survey: What GPUs do you use for local inference? 3090/4090 still dominate

ocean_protocol · reddit · 2026-07-30

A Reddit user surveys what GPUs people actually use for local inference. Most replies still use 3090/4090 for models like Llama 3 8B, Mistral 7B; a few use A100/H100 as used prices drop. For larger models like Llama 3 70B, some use multi-GPU or quantized GGUF on a single card.

Original post →

More from Infra

Infra channel →