DeepSeek-V4-Flash MXFP4/8 量化版发布

HaihaoShen · x · 2026-08-06

Intel 团队发布了与 MX(Microscaling)格式完全兼容的 DeepSeek-V4-0731-Flash 量化模型。该版本针对原生硬件优化了推理过程,主要差异在于:稠密线性层使用 MXFP8 格式(对比常规 FP8),MoE 线性层则采用 MXFP4 权重与 MXFP4 激活值的组合(对比常规的 MXFP4 权重与 FP8 激活值)。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →