开源硬件 Roofline 计算器:一步估算 LLM 推理速度理论上限

Informal-Trouble2183 · reddit · 2026-09-28

一位开发者发布了 LLM 推理硬件 Roofline 计算器,可根据模型架构、量化方案、GPU、显存带宽等参数,估算 decode/prefill 阶段的理论性能上限。作者强调这是理论边界而非实测,但适合作为「第 0 步」检查:判断你的硬件能装下什么模型、各瓶颈参数如何影响性能。工具可在 ai-leaderboard.dev 点击 HW Roofline 使用。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →