DeepSeek-V4-Flash 架构曝光:284B 总参,FP4 混合精度,原生支持百万上下文

vllm_project · x · 2026-08-01

vLLM Recipes 页面意外泄露了 DeepSeek-V4-Flash 模型的详细技术文档。作为 V4 预览家族的新成员,该模型总参数量达 284B,激活参数仅为 13B。

核心架构亮点:

部署与变体:

模型基于 32T+ tokens 预训练,采用两阶段后训练流水线。官方提供了四个变体检查点,包括原生 FP4+FP8 混合权重版,以及由 NVIDIA 重新量化的 NVFP4 版本(专为 Blackwell GPU 优化)。

所属事件:DeepSeek-V4-Flash架构曝光:主打百万上下文(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →