DeepSeek 发布 V4.1Flash:552B MoE,CED 非对称架构大幅降推理成本

APPSO · wechat · 2026-09-10

DeepSeek 正式发布 DeepSeek V4.1 Flash,已上线官网、App 和 API 端。这是一个 552B 参数的 MoE 模型,但不走堆规模路线,而是通过新架构和缓存管理重新优化运行方式,并具备原生多模态视觉理解能力。

技术报告显示,新模型采用全新的 CausalEncoderDecoder(CED)非对称架构:输入阶段激活约 8B 参数、输出阶段激活约 16B,兼顾能力上限与推理成本。配合 CompressedSparseAttention2(跨层复用 KVCache 并结合 Top-K 索引,分 Full/Reindex/Reuse 三种模式)、FP4 KV Cache 和 DSpark 预测式生成技术,HBM 需求降至上一代的 1/4,SSD 需求降至 1/8,相比初代 KVCache 规模已缩小约 437 倍。

综合优化与大规模强化学习后训练后,V4.1 Flash 在多项 Agent 能力测试中超过包括 V4 Pro 在内的旗舰模型,API 价格同步下调并保留峰谷定价。DeepSeek 将逐步下线 V4 Pro,请求将自动路由至 V4.1 Flash 并按其价格计费。同时发布的 Harness v0.1.5 支持保留 KVCache 更新系统提示词、父子 Agent 双向通信、以及实验性多 Agent 协作功能 AgentTeams。腾讯 WorkBuddy、CodeBuddy 及 OpenCode 已接入。

所属事件:DeepSeek 开源发布 V4.1 Flash,超旗舰低价引热议(57 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →