NVIDIA 发布 Qwen3.8-Flash-Next NVFP4 量化模型,支持图文输入
nvidia · hf · 2026-09-05
NVIDIA 在 Hugging Face 上发布了 Qwen3.8-Flash-Next-NVFP4 模型,登上热门榜。该模型是基于 Qwen3.8 的 FP4 量化版本,使用 NVIDIA Model Optimizer(ModelOpt)量化,safetensors 格式,pipeline 类型为 image-text-to-text,即支持图文到文本的多模态推理,主要面向低精度推理部署场景。
所属事件:NVIDIA 发布 Qwen3.8-Flash-Next NVFP4 量化模型(2 条相关)→
「模型」频道最新
- OpenAI 回应「wiki 事故」:将首次定义对齐事故的披露标准 — sjgadler · 2026-09-05
- 用户吐槽 GPT-6 各端可用性混乱:Chat 有 Pro 版,Codex 却没有 — justalexoki · 2026-09-05
- 网友让 Astra 生成同时满足时空对称性的动画 — yaroslavvb · 2026-09-05
- 3D 艺术家实测 GPT-6:一个 prompt 组装整车并做动画 — petewoodbridge · 2026-09-05
- 同题横评:Ministral 14B 与 Qwen3.8-27B 表格查询全对,Gemma 4 幻觉翻车 — andrejusb · 2026-09-05
- Astra 计算机使用实测:五分钟才完成一步,与宣传差距大 — bubu19999 · 2026-09-05