oMLX 0.7.1.dev1 adds decision models and batched prefill, +31% Qwen3.6 decode speed on M5 Max

pcuenq · x · 2026-10-10

oMLX 0.7.1.dev1 brings notable updates for local inference on Apple Silicon:

Original post →

More from Infra

Infra channel →