Qwen3.8-Flash-Next 量化新方案:体积砍到约 1/5,跑分几乎无损

BullfrogScary8947 · reddit · 2026-09-16

ISTA-DASLab 发布 Qwen3.8-Flash-Next 的 GSQ-RCO GGUF 量化版本,把约 80-95GB 的模型压到 68-76GB,并保持接近基线的质量。要点:

模型已在 Hugging Face 上线,适合本地部署时按吞吐/质量需求选档。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →