SGLang社区项目新增MoE支持与加速
社区项目正在为SGLang引入混合专家模型支持,以进一步提升其运行效率。此次更新的核心能力包括提供可配置的offloading以及引入SM120 kernels。这一加速方案受到了社区的广泛关注与转发,展现了开源生态在优化大模型底层推理性能方面的持续探索。
2026-07-13 ~ 2026-07-13 · 2 条相关
- SGLang 社区项目加速 MoE 支持 — BanghuaZ · 2026-07-13
- SGLang 新增 MoE 支持 — BanghuaZ · 2026-07-13