DeepSeek-V4-Pro 正式发布:1.6T 参数 MoE,推理成本降至 V3.2 的 27%

AccBalanced · x · 2026-08-14

DeepSeek 正式发布旗舰模型 DeepSeek-V4-Pro,采用 1.6T 总参数 / 49B 激活的 MoE 架构,结合 CSA+HCA 混合注意力与流形约束超连接,推理 FLOPs 仅为 V3.2 的 27%,1M 上下文下 KV 缓存降至 10%。模型基于 Muon 优化器在 32T+ tokens 上预训练,支持 FP4+FP8 混合精度,并原生支持 OpenAI Responses API,针对 Codex 优化。vLLM 已支持,无需重建配置。DeepSeek 同时开源了 agent harness,可对接任意 OpenAI 兼容接口。

所属事件:DeepSeek-V4-Pro发布:1.6T参数MoE,推理成本大降(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →