Running a 27B model locally on 2x RTX 5090 with vLLM

piddlefaffle12 · reddit · 2026-09-25

A Reddit user shared a screenshot of running a 27B-class open model locally via vLLM on two RTX 5090 GPUs under CachyOS — a practical consumer dual-GPU local inference setup reference.

Original post →

More from Infra

Infra channel →