Qwen3.8-Flash-Next 发布 1-4bit GGUF 量化版

MaziyarPanahi · x · 2026-08-27

Unsloth AI 发布了 Qwen3.8-Flash-Next 的 GGUF 量化版本,涵盖 1bit 到 4bit 精度。作者建议用户使用 llama.cpp 进行推理部署。

所属事件:Qwen3.8-Flash 支持 75GB 内存本地运行并推量化版(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →