Qwen3.8-Flash-Next 发布 1-4bit GGUF 量化版
MaziyarPanahi · x · 2026-08-27
Unsloth AI 发布了 Qwen3.8-Flash-Next 的 GGUF 量化版本,涵盖 1bit 到 4bit 精度。作者建议用户使用 llama.cpp 进行推理部署。
所属事件:Qwen3.8-Flash 支持 75GB 内存本地运行并推量化版(2 条相关)→
「模型」频道最新
- 更正:GLM-5.3-Flash 上下文窗口为 100 万 — ArtificialAnlys · 2026-08-27
- Gemini 3.5 Transcribe 发布,支持 85+ 语言与函数调用 — osanseviero · 2026-08-27
- 实测:Gemini 3.7 Flash 前端开发表现超预期 — doodlestein · 2026-08-27
- Qwen3.8 27B 量化评测:4-bit 表现稳健,1-bit 崩溃 — pmigdal · 2026-08-27
- GLM-5.3-Flash 评测:成本仅大模型 10%,登顶性价比 frontier — ArtificialAnlys · 2026-08-27
- Google 公布 Gemini 3.7 Flash 定价详情 — OfficialLoganK · 2026-08-27