vLLM details multi-node DSpark training for Kimi K3 on GB300 NVL72

vLLM Blog · rss · 2026-09-15

The vLLM team publishes an engineering writeup on training the fastest DSpark (speculative decoding configuration) for Kimi K3, using multi-node GB300 NVL72 clusters with Speculators and Mooncake. Covers the multi-node speculative decoding training pipeline and implementation details.

Original post →

More from Infra

Infra channel →