本地 LLM 量化避坑指南:FP8/NVFP4 等格式的硬件门槛

Ill_Dragonfruit_3547 · reddit · 2026-08-20

作者分享了在本地运行 LLM 时关于量化和硬件兼容性的经验教训,指出量化格式是基于硬件而非仅仅为了压缩大小。

硬件代际与支持格式:

格式分类与选择规则:

核心建议:在 M1Max 上,LLM 选 MLX,Diffusion 选 GGUF 或 fp16 safetensors,其他格式大概率会报错或性能极差。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →