通义 Qwen3.8 发布 Flash-Next FP8 量化版
Qwen · hf · 2026-08-27
阿里通义团队在 Hugging Face 发布 Qwen3.8-Flash-Next-FP8 模型。该模型基于 Qwen3.8-Flash-Next 进行 FP8 量化,采用 image-text-to-text 架构,支持多模态对话与推理,适配端点部署。
「模型」频道最新
- GLM-5.3-Flash 发布:320B MoE 架构,MIT 开源 — TheZachMueller · 2026-08-27
- Claude 口头禅「这不是X而是Y」更可能来自后训练而非互联网数据 — burkov · 2026-08-27
- 307M 参数小模型 LateOn,在评测中击败 26 倍大的 Qwen — lateinteraction · 2026-08-27
- GLM-5.3-flash 效率拆解:十分之一成本胜前代,激活参数近乎减半 — baseten · 2026-08-27
- 跨模型 Token 比较无意义,推理时代指标更需细分 — adamdangelo · 2026-08-27
- Yutori 发布 n2 模型,低成本实现全桌面计算机控制 — DhruvBatra_ · 2026-08-27