vLLM Releases Inkling-Small Deployment Guide: Runs on Minimum 180GB VRAM

vllm_project · x · 2026-07-31

vLLM Recipes has officially released a deployment guide for Thinking Machines Lab's latest multimodal MoE model, Inkling-Small.

Original post →

More from Infra

Infra channel →