NVIDIA 上架 DeepSeek-V4.1-Flash NVFP4 量化版,MIT 协议开源
TheZachMueller · x · 2026-09-17
NVIDIA 在 Hugging Face 发布了基于 DeepSeek-V4.1-Flash 的 NVFP4 量化版本(仓库 nvidia/DeepSeek-V4.1-Flash-NVFP4),使用其 Model Optimizer 工具链完成量化。
- 模型为 image-text-to-text 多模态模型,基于 deepseek-ai/DeepSeek-V4.1-Flash
- 采用 FP4/8-bit 量化格式,面向更低显存占用与更快的推理部署
- 许可证为 MIT,保持开源
对想在本地或端侧跑 DeepSeek V4.1 的开发者,这是一个现成的低精度部署选项。
所属事件:NVIDIA开源DeepSeek-V4.1-Flash的NVFP4量化版(2 条相关)→
「Infra」频道最新
- llama.cpp 加载 Qwen3.8 MTP 草稿模型报错,tensor 缺失无解 — Ambitious_Fold_2874 · 2026-09-17
- 预测:18个月内Kimi K3级智能将跑在单张RTX 5090上 — TheZachMueller · 2026-09-17
- 有用户称愿为 AI 订阅月付 1000 美元,但定价过高会推向本地部署 — draginol · 2026-09-17
- 腾讯开源 FlexKV 分布式 KV 缓存:TTFT 最高降 70%,吞吐提升 16% — Roger_M_Taylor · 2026-09-17
- Bittensor 挖矿优化被 vLLM 收编,Qwen3 吞吐提升约 4% — const_reborn · 2026-09-17
- vLLM 出现 DiffusionGemma 结构化生成 PR,单机 DGX Spark 延迟亮眼 — generativist · 2026-09-17