Qwen3.8-Flash-Next FP8 量化模型在 Hugging Face 发布
阿里通义团队与社区(unsloth)相继在 Hugging Face 发布 Qwen3.8-Flash-Next-FP8 模型。该模型基于 Qwen3.8-Flash-Next 进行 FP8 量化,在保持能力的同时降低资源消耗,为开发者提供了更易部署的量化版本选择。
2026-08-27 ~ 2026-08-27 · 2 条相关
- 第 1 集:阿里官宣 Qwen3.8-Flash-Next 开源,预览 Qwen4 架构(2026-08-25,13 条)
- 第 2 集:阿里开源Qwen3.8-Flash-Next预览Qwen4架构(2026-08-26,23 条)
- 第 3 集:Qwen3.8 Flash 登顶 SWE-bench Pro,成本仅竞品九分之一(2026-08-26,2 条)
- 第 4 集:Qwen3.8-Flash 支持 75GB 内存本地运行并推量化版(2026-08-26,2 条)
- 第 5 集:Qwen3.8-Flash-Next FP8 量化模型在 Hugging Face 发布(2026-08-27,2 条)
- 第 6 集:Qwen 3.8-Next 发布,技术报告详解架构与预训练(2026-08-27,2 条)
- Unsplash 发布 Qwen3.8 FP8 多模态量化版 — unsloth · 2026-08-26
- 通义 Qwen3.8 发布 Flash-Next FP8 量化版 — Qwen · 2026-08-27