4×3090 实测:Gemma 3.8 27B Q8 比 Next IQ3 82GB 更快也更准

Repulsive_Initial308 · reddit · 2026-08-28

一位用 4 张 RTX 3090 跑 llama.cpp 的用户分享了 3.8 Next IQ3 量化的初步测试:结论是「Meh」。其混合跑 Q4/Q8/BF16 的方案已接近完美,而 3.8 27B Q8KXL(权重 32GB)在安全漏洞评估能力和推理速度上都大幅优于 3.8 Next IQ3(权重高达 82GB)。作者也承认现在还属早期,后续可能有变化。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →