DeepSeek-V4-Pro 正式发布:1.6T 参数 MoE,推理成本降至 V3.2 的 27%
AccBalanced · x · 2026-08-14
DeepSeek 正式发布旗舰模型 DeepSeek-V4-Pro,采用 1.6T 总参数 / 49B 激活的 MoE 架构,结合 CSA+HCA 混合注意力与流形约束超连接,推理 FLOPs 仅为 V3.2 的 27%,1M 上下文下 KV 缓存降至 10%。模型基于 Muon 优化器在 32T+ tokens 上预训练,支持 FP4+FP8 混合精度,并原生支持 OpenAI Responses API,针对 Codex 优化。vLLM 已支持,无需重建配置。DeepSeek 同时开源了 agent harness,可对接任意 OpenAI 兼容接口。
所属事件:DeepSeek-V4-Pro发布:1.6T参数MoE,推理成本大降(4 条相关)→
「Infra」频道最新
- Orion-16B突破100B训练token,采用去中心化算力 — const_reborn · 2026-08-15
- 为什么不用P2P下载AI模型?Hugging Face单点成隐患 — deathcom65 · 2026-08-15
- Qwen3.8获LightSeek Day-0支持,推理性能提升30%+ — Alibaba_Qwen · 2026-08-15
- 自托管模型用抢占式云实例划算吗?Reddit热议成本与可行性 — Different-Monk5916 · 2026-08-15
- 马斯克:2029 年轨道计算或成 AI 扩展唯一途径 — elonmusk · 2026-08-15
- Qwen3.8-27B-FP8在GH200上实现10路并发流式推理,首包延迟10ms — MaziyarPanahi · 2026-08-15