vLLM 用 GB300 NVL72 多节点 DSpark 训练出最快的 Kimi-K3
vLLM Blog · rss · 2026-09-15
vLLM 团队发布工程复盘:如何借助 GB300 NVL72 多节点集群,结合 Speculators 与 Mooncake,为 Kimi K3 训练出速度最快的 DSpark(推测解码/speculative decoding 配置)。文章覆盖多节点推测解码训练的具体实现路径与工程细节。
「Infra」频道最新
- Oracle 裁员次日新 CFO 全员会:不喜欢「少花钱多办事」这个说法 — mkheck · 2026-09-16
- OpenAI 透露 Astra 在 Rubin 芯片上自我优化 72 小时推理再翻倍 — bookwormengr · 2026-09-16
- 开源端侧语音模型 Audio8:ASR/TTS 七个规格,iPhone 离线转写可用 — FinanceYF5 · 2026-09-16
- RTX Pro 6000 全面售罄,买家称交货周期已长达 8 个月 — Sentdex · 2026-09-16
- Anthropic 已官宣超 11.5GW 算力,满负荷年账单或达 1200 亿美元 — FinanceYF5 · 2026-09-16
- NVIDIA 官方讲解:Dense 与 MoE 架构如何选,部署权衡全解析 — NVIDIA Developer · 2026-09-16