SGLang-Diffusion 发布:面向扩散模型的高性能推理服务框架

PyTorch · x · 2026-10-10

PyTorch 官方宣布 SGLang-Diffusion,一个面向扩散模型的高性能服务框架,同时支持大规模离线生成和对延迟敏感的实时推理。RadixArk 的 Yihao Wang 和 Kevin Mi 将在 2026 年 10 月 20-21 日圣何塞举行的 PyTorch Conference North America 上介绍其设计及基于 PyTorch 的推理优化,包括高效请求调度、内存管理、批处理策略和扩散 pipeline 的执行路径优化。

所属事件:SGLang-Diffusion 扩散模型推理框架发布并将亮相 PyTorch 大会(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →