NVIDIA 公布 Qwen3.8-2.4T 模型部署方案:GB300 显卡吞吐超 4000 tokens/s

PyTorch · x · 2026-08-21

NVIDIA 发布技术博客,详细介绍如何在其 NVIDIA GB300 NVL72 平台上部署阿里巴巴最新发布的开源大模型 Qwen3.8-2.4T-A95B。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →