DeepSeek发布V4.1-Flash:552B MoE原生视觉,1M上下文MIT开源
DeepSeek 于 9 月 10 日正式发布并开源新模型 V4.1 Flash,在网页、App 与 API 三端同步上线,API 模型名为 deepseek-flash。这是当前最值得关注的新一代开源模型发布之一:性能据称全面超越自家旗舰 V4 Pro,同时价格大幅下降。
已确认
- 架构与规模:552B 总参数的非对称 MoE 模型,采用全新 Causal-Encoder-Decoder 架构,输入侧仅激活 8B 参数、输出侧激活 16B,支持最高 100 万 token 上下文,KV 缓存开销节省 7/8。
- 基准表现:据 @ChrisGPT 转述,V4.1 Flash 在多个智能体/编码基准上超过 GPT-5.6 Sol 与 Opus 5,如 CyberGym 88.1 vs 84.5;输入价格低至 $0.14/M。
- V4 Pro 退役与路由:官方公告称,鉴于 V4.1 Flash 在性能、费用、速度、总用时等指标上全面超越 V4 Pro,在 V4.1 Pro 上线前,所有 V4 Pro 请求将被自动路由到 V4.1 Flash 并按更低价格计费。多名用户(如 @gaganghotra)已收到相关弃用通知。
- 旧模型下线:官方 API 公告披露 V4-Flash 与 V4-Flash-Vision-E 等旧模型将退役。
为什么重要
- V4.1 Flash 以显著更低的激活参数量和成本达到超越旗舰 V4 Pro 的表现,配合开源发布,可能进一步压低行业推理价格并冲击闭源模型厂商。
- V4 Pro 用户需注意自动路由带来的行为变化,依赖其能力的开发者应在切换前评估 V4.1 Flash 的实际表现。
- 百万 token 上下文与 7/8 的 KV 缓存节省,对长文档与智能体工作流场景的可用性和成本有直接影响。
2026-09-09 ~ 2026-09-10 · 25 条相关
- 第 1 集:DeepSeek V4.1 Flash 限时内测:新架构原生多模态(2026-09-08,18 条)
- 第 2 集:DeepSeek V4.1 Flash实测:极速350 tokens/s但偏实验性(2026-09-08,2 条)
- 第 3 集:DeepSeek V4-Flash 系列降价,错峰缓存命中低至 0.02 元(2026-09-08,6 条)
- 第 4 集:DeepSeek V4.1 Flash实测:视觉与安全能力大跃升,价格更低(2026-09-09,3 条)
- 第 5 集:DeepSeek发布V4.1-Flash:552B MoE原生视觉,1M上下文MIT开源(2026-09-09,25 条)
- 第 6 集:DeepSeek V4.1 Flash 实测:98% 性能仅 1.4% 成本(2026-09-09,2 条)
- 第 7 集:DeepSeek V4.1/Flash 跑分与架构爆料集中流出(2026-09-10,12 条)
一手来源
- DeepSeek-V4.1-Flash 上线 API:KV 缓存省 7/8,V4-Pro 将被淘汰 — deepseek_ai ·
- DeepSeek 开源 V4.1 Flash:552B 非对称 MoE 架构,砍掉 V4 Pro — 机器之心 ·
- DeepSeek:V4 Pro 请求将被路由到更快的 V4.1 Flash 并降价计费 — zephyr_z9 ·
- 【源头】DeepSeek:V4 Pro 请求将被路由到更快的 V4.1 Flash 并降价计费 — zephyr_z9 · 2026-09-09
- DeepSeek 发布 V4.1 Flash,综合成本降 22% 且性能更强 — deliprao · 2026-09-09
- DeepSeek 发布 V4.1 Flash:552B MoE 新架构,MIT 开源 — deepseek-ai · 2026-09-10
- DeepSeek 发布 V4.1 Flash:552B MoE 超旗舰,降价并下线 V4 Pro — DeepSeek · 2026-09-10
- DeepSeek 发布 V4.1-Flash:原生视觉理解的新架构家族首发 — deepseek_ai · 2026-09-10
- 非对称新架构:552B MoE 输入仅激活 8B,跑分超自家旗舰 — deepseek_ai · 2026-09-10
- 【源头】DeepSeek-V4.1-Flash 上线 API:KV 缓存省 7/8,V4-Pro 将被淘汰 — deepseek_ai · 2026-09-10
- V4.1-Flash 开源上架 HF:MIT 协议,谷峰价差 50%,附论文 — deepseek_ai · 2026-09-10
- DeepSeek V4.1 Flash 发布:552B MoE 仅激活 8B,价格低至 $0.14/M — ChrisGPT · 2026-09-10
- DeepSeek 疑将下线 v4 Pro,请求全部转向新版 v4.1 Flash — gaganghotra_ · 2026-09-10
- DeepSeek V4.1 Flash 开源发布:552B MoE、1M 上下文、SGLang 零日支持 — BanghuaZ · 2026-09-10
- V4.1 Flash 详解:每 token 缓存缩至 890 字节,闲时命中仅 2 分 — 赛博禅心 · 2026-09-10
- DeepSeek-V4.1-Flash 现身 Hugging Face:MIT 协议、多模态、FP8 权重 — AIFlow_ML · 2026-09-10
- DeepSeek V4.1 Flash 权重开源上线 HF,MIT 协议支持图文输入 — solyarisoftware · 2026-09-10
- DeepSeek V4.1 Flash 上线 App/Web/API,开源权重照旧 — gaganghotra_ · 2026-09-10
- Perplexity CEO 惊叹 DeepSeek V4.1 Flash 发布 — keviv9 · 2026-09-10
- DeepSeek V4.1 Flash 发布:769B MoE 原生视觉,1M 上下文 vLLM 零日支持 — solyarisoftware · 2026-09-10
- DeepSeek's official reveal of a new architecture: 552B MoE, only 8B active for input — zephyr_z9 · 2026-09-10
另有 7 条近重复转述:机器之心 · eliebakouch · reach_vb · teortaxesTex · basedjensen · Scobleizer · Scobleizer