DeepSeek 发布 V4.1Flash:552B MoE,CED 非对称架构大幅降推理成本
APPSO · wechat · 2026-09-10
DeepSeek 正式发布 DeepSeek V4.1 Flash,已上线官网、App 和 API 端。这是一个 552B 参数的 MoE 模型,但不走堆规模路线,而是通过新架构和缓存管理重新优化运行方式,并具备原生多模态视觉理解能力。
技术报告显示,新模型采用全新的 CausalEncoderDecoder(CED)非对称架构:输入阶段激活约 8B 参数、输出阶段激活约 16B,兼顾能力上限与推理成本。配合 CompressedSparseAttention2(跨层复用 KVCache 并结合 Top-K 索引,分 Full/Reindex/Reuse 三种模式)、FP4 KV Cache 和 DSpark 预测式生成技术,HBM 需求降至上一代的 1/4,SSD 需求降至 1/8,相比初代 KVCache 规模已缩小约 437 倍。
综合优化与大规模强化学习后训练后,V4.1 Flash 在多项 Agent 能力测试中超过包括 V4 Pro 在内的旗舰模型,API 价格同步下调并保留峰谷定价。DeepSeek 将逐步下线 V4 Pro,请求将自动路由至 V4.1 Flash 并按其价格计费。同时发布的 Harness v0.1.5 支持保留 KVCache 更新系统提示词、父子 Agent 双向通信、以及实验性多 Agent 协作功能 AgentTeams。腾讯 WorkBuddy、CodeBuddy 及 OpenCode 已接入。
所属事件:DeepSeek 开源发布 V4.1 Flash,超旗舰低价引热议(57 条相关)→
「编程与Agent」频道最新
- 开发者用旧任务评测 Jev 提示词,称彻底解决 agent 提前停工 — willcb · 2026-09-19
- Univer 发布 Office Harness,让 AI Agent 原生操作表格文档幻灯 — alifcoder · 2026-09-19
- 编程工具额度实测:Claude Code 比 Codex 更耐用,重活仍易烧穿 — Standard_Soil4738 · 2026-09-19
- 开源世界模型 Utopia 走红:双时态知识图谱自动演化并检测冲突 — tom_doerr · 2026-09-19
- Hermes Agent 新增按发送者 user_id 路由消息到独立 Profile — Teknium · 2026-09-19
- SWE-2 一把过:最小提示一次性写出高完成度 GBA 模拟器 — CtrlAltDwayne · 2026-09-19