Red Hat AI 上架 Qwen3.8-Flash-Next NVFP4 量化版,MoE 专家 FP4、vLLM 即用
huggingface · x · 2026-10-05
Red Hat AI 在 Hugging Face 发布了 Qwen3.8-Flash-Next 的 NVFP4 量化 checkpoint:
- MoE 专家权重量化到 FP4,其余部分保留 BF16
- 支持文本、图像、视频输入的多模态模型
- 针对 vLLM 推理开箱即用
- 团队同时发布了与其他热门 checkpoint 的对比 benchmark
对想在 NVIDIA 硬件上压低显存、提高吞吐的本地部署玩家是一个现成选项。
「Infra」频道最新
- 马斯克确认台积电正洽谈合作,为其德州 Terafab 建芯片 — Polymarket · 2026-10-06
- 12GB显卡本地跑MiniMax H3做电影预告片:0.6MP+4:3是甜点 — vortis23 · 2026-10-06
- AI数据中心扩张撞上电网天花板,多个规划项目被迫撤回 — DavidLinthicum · 2026-10-05
- 麒麟 9050 传用 1.5 微米 HBI 封装,分析师称量产才是真正难关 — teortaxesTex · 2026-10-05
- PGlite 周下载量突破 2000 万,浏览器内 Postgres 增长迅猛 — matei_zaharia · 2026-10-05
- 本科生魔改 GPTQ:4-bit Qwen2.5 困惑度优于官方 AWQ — Status-Adeptness8123 · 2026-10-05