Running AI Agents on CPU: Gemma 4 26B vs Qwen 3.6 35B?

Kahvana · reddit · 2026-08-18

A user asks for advice on choosing a model to run an Agent on CPU for web search and document parsing, requiring 256K context support. Options include Gemma 4 26B-A4B (for natural language skills) and Qwen 3.6 35B-A3B (for lighter resource usage). The user has 96GB RAM but GPU VRAM is fully occupied. Seeking recommendations for CPU-friendly agent models and experiences with what works or doesn't.

Original post →

More from coding & agent

coding & agent channel →