Local Qwen3.8-flash Test: Strix Halo and a 94GB-Modded RTX 3090 Both Hit ~50 tok/s

drdanielbender · x · 2026-10-09

A side-by-side local inference test of qwen3.8-flash-next across two setups:

A direct hardware/software combo reference for developers eyeing local deployment and privacy-focused workflows.

Original post →

More from Infra

Infra channel →