Lessons from running a local Qwen 27B overnight on long-horizon coding across 2 GPUs

paulqq · reddit · 2026-09-26

A developer ran a local Qwen 27B on llama.cpp (tensor-split across an RTX 4080 SUPER + RTX A4000) inside a deepseek harness for about a day, building two small agent-harness tools, and shared detailed lessons.

What worked

What didn't

He frames it as pairing: the model wrote most code, the human set rules, accepted/rejected, and made the ship call.

Original post →

More from coding & agent

coding & agent channel →