DeepSeek-V4-Flash MXFP4/8 量化版发布
HaihaoShen · x · 2026-08-06
Intel 团队发布了与 MX(Microscaling)格式完全兼容的 DeepSeek-V4-0731-Flash 量化模型。该版本针对原生硬件优化了推理过程,主要差异在于:稠密线性层使用 MXFP8 格式(对比常规 FP8),MoE 线性层则采用 MXFP4 权重与 MXFP4 激活值的组合(对比常规的 MXFP4 权重与 FP8 激活值)。
「Infra」频道最新
- 实测 SageAttention:H3 视频生成提速约 28% 且画质无损 — Oatilis · 2026-08-06
- 本地生图降温降噪技巧:限制 GPU 功耗收益大 — ForsakenAd1228 · 2026-08-06
- 推荐免费《推理工程》入门书及读书会活动 — Al_Grigor · 2026-08-06
- x402标准获Linux基金会接管,AWS与谷歌等巨头支持AI智能体支付 — 0xJeff · 2026-08-06
- 基于 Bittensor 搭建去中心化私人 AI 推理集群 — markjeffrey · 2026-08-06
- 马斯克:长期来看 99% 的算力将用于模型推理 — jamesdouma · 2026-08-06