SGLang社区项目新增MoE支持与加速

社区项目正在为SGLang引入混合专家模型支持,以进一步提升其运行效率。此次更新的核心能力包括提供可配置的offloading以及引入SM120 kernels。这一加速方案受到了社区的广泛关注与转发,展现了开源生态在优化大模型底层推理性能方面的持续探索。

2026-07-13 ~ 2026-07-13 · 2 条相关