开发者做了 GGUF 显存计算器:输入显卡即可知道哪个量化能跑

asankhs · reddit · 2026-09-17

LocalLLaMA 社区开发者发布了 local-model-explorer:输入你的 GPU/RAM 或 Mac、Strix Halo、DGX Spark 的统一内存,选定上下文长度和 KV cache 类型后,它会对约 3000 个热门 GGUF 模型按是否放得下排序。

亮点:

不估算速度,但可以粘贴自己的 llama-bench 结果,数据集公开。Mac 另有 MLX 版本。

所属事件:LocalLLaMA 开发者推出 GGUF 显存计算器(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →