FP8 调优砍掉 42.9ms,SGLang 自改内核推理提速 126%

HankYeomans · x · 2026-09-23

作者分享在 RTX 6000 Pro 上做 LLM 推理优化的阶段性成果与心得。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →