NVIDIA DGX Station 实测:Qwen3.8-27B 推理达 2713 tok/s

NVIDIAAI · x · 2026-08-20

实测数据显示,NVIDIA DGX Station 在 BF16 精度下全权重服务 Qwen3.8-27B 模型时表现惊人:峰值聚合吞吐量超过 2713 tok/s,单流输出速度达 88 tok/s。这使其在家用环境中具备了数据中心级别的推理能力。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →