实测 2017 年 1080Ti 跑稠密模型反比 RTX 6000 快 2.4 倍

EAccelerate_42 · x · 2026-09-22

一条关于 GPU 推理性能测算的反直觉发现:比较 RTX 6000(1792GB/s 带宽)与 1080 Ti(484GB/s 带宽)加载占 80% 显存的稠密模型时,带宽低得多的 1080 Ti 反而更快。

2017 年的旧卡 token 输出速度反而快 2.4 倍。作者提醒:估算 GPU 推理速度时不能只看显存带宽,还要看每秒 sweep 数,大模型下带宽高的卡未必更快。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →