AMD 官方 Qwen3.8 MXFP4 量化无法在 llama.cpp 加载

mailto_devnull · reddit · 2026-09-03

一位用户受他人「双卡 R9700 跑出极高推理速度」启发,想在单卡上尝试 AMD 官方发布的 Qwen3.8-27B MXFP4 量化版(HF: amd/Qwen3.8-27B-Quark-AWQ-MXFP4),但发现其 safetensors 无法在 llama.cpp 中加载;转而下载社区做的 GGUF 版(magiccodingman 的 MagicQuant 版)同样加载失败。帖子提出的问题直指现状:llama.cpp 目前似乎尚不支持 MXFP4 格式。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →