曝DeepSeek V4.1 Flash跑分:552B非对称MoE架构
9 月 10 日,多位博主集中曝光了据称是 DeepSeek V4.1 及 V4.1 Flash 的官方基准成绩与技术细节,官方尚未确认任何信息,iScienceLuvr 等博主也公开质疑成绩可能存在「刷榜」成分。
已确认
- 信息均为未经官方证实的爆料,主要来自 teortaxesTex、eliebakouch、ChrisGPT、nrehiew、iScienceLuvr 及 @sheriyuo(经 AndrewZhao 转发)等博主,各帖数据相互印证。
- 模型总参数 552B,采用全新 Causal-Encoder-Decoder 架构,输入激活 8B、输出激活 16B;nrehiew 补充称同一模型在预填充与解码两个阶段激活不同数量的参数(预填充 16B、解码 8B),属此前少见的设计。@sheriyuo 与转发链均强调其成本显著低于同尺寸模型,iScienceLuvr 则称其「智能超自家旗舰」。
- 曝光跑分:TerminalBench 4.0 得 31.2,CyberGym 88.1(对比 GPT-5.6 Sol 的 84.5),HLE 63.9;ChrisGPT 称多项 agentic/编码基准超越 GPT-5.6 Sol;nrehiew 称 V4.1 Flash 在 DeepSWE 以 74.2 分登顶,超过 Opus 5 与 Gemini 3.8 Flash。
- eliebakouch 引述的技术报告显示 V4.1 Flash 为原生视觉模型,训练于 45T tokens,架构被赞为近年最新颖。
架构与工程亮点
- 据 teortaxesTex 爆料,KV cache 压缩至 890 字节/token,百万 token 不足 1GB;相比 V4-Flash,HBM 需求再降 3.9 倍,SSD 需求降 8 倍,且发布半年后仍未被超越。
- 同据 teortaxesTex,V4.1 砍掉 V4 的临时补丁:放弃 HCA、将 CSA 泛化为更通用原语、去掉稀疏注意力的 warmup 阶段、采用更简单的单遍 mHC。
尚未确认
- 所有跑分、参数规格与架构细节均无官方来源,最终发布版本可能存在差异;iScienceLuvr 明确表示对「GPT-5.6 Sol 级别」的成绩持怀疑态度。
为什么重要
- 若爆料属实,V4.1 在 agentic/编码能力上正面挑战 GPT-5.6 Sol,同时凭借不对称激活与极致 KV 压缩大幅降低部署显存门槛,在开源开放生态下对推理成本影响显著。
2026-09-10 ~ 2026-09-10 · 12 条相关
- 第 1 集:DeepSeek V4.1 Flash 疑似内测曝光,新架构原生多模态(2026-09-08,18 条)
- 第 2 集:DeepSeek V4.1 Flash实测:极速350 tokens/s但偏实验性(2026-09-08,2 条)
- 第 3 集:DeepSeek V4-Flash 系列降价,错峰缓存命中低至 0.02 元(2026-09-08,6 条)
- 第 4 集:DeepSeek V4.1 Flash实测:视觉与安全能力大跃升,价格更低(2026-09-09,3 条)
- 第 5 集:DeepSeek发布V4.1-Flash:552B MoE原生视觉,1M上下文MIT开源(2026-09-09,25 条)
- 第 6 集:DeepSeek V4.1 Flash 实测:98% 性能仅 1.4% 成本(2026-09-09,2 条)
- 第 7 集:曝DeepSeek V4.1 Flash跑分:552B非对称MoE架构(2026-09-10,12 条)
一手来源
- 曝 DeepSeek V4.1 跑分:552B 新架构,HLE 63.9、TerminalBench 31.2 — teortaxesTex ·
- DeepSeek V4.1 Flash 登顶 DeepSWE:74.2 分超 Opus 5 与 Gemini 3.8 Flash — nrehiew_ ·
- DeepSeek V4.1 Flash 曝光:552B 总参、原生视觉,架构被赞近年最新颖 — eliebakouch ·
- 【源头】曝 DeepSeek V4.1 跑分:552B 新架构,HLE 63.9、TerminalBench 31.2 — teortaxesTex · 2026-09-10
- DeepSeek V4.1 架构再进化:HBM 需求降至 1/3.9,跑分全面刷新 — teortaxesTex · 2026-09-10
- KV 压至 890 字节/token:DeepSeek V4.1 Flash 显存需求降 3.9 倍 — teortaxesTex · 2026-09-10
- 曝 DeepSeek V4.1 Flash:552B MoE 非对称架构,智能超自家旗舰 — _AndrewZhao · 2026-09-10
- DeepSeek V4.1 Flash 跑分曝光:编码与 agent 基准多项超 GPT-5.6 Sol — ChrisGPT · 2026-09-10
- 【源头】DeepSeek V4.1 Flash 曝光:552B 总参、原生视觉,架构被赞近年最新颖 — eliebakouch · 2026-09-10
- 爆料称 DeepSeek V4.1 砍掉 V4 补丁:弃 HCA、泛化 CSA、免稀疏预热 — zephyr_z9 · 2026-09-10
- 【源头】DeepSeek V4.1 Flash 登顶 DeepSWE:74.2 分超 Opus 5 与 Gemini 3.8 Flash — nrehiew_ · 2026-09-10
- 曝 DeepSeek 发布 V4.1-Flash:552B 参数自称达 GPT-5.6 水平 — iScienceLuvr · 2026-09-10
- 曝 DeepSeek V4.1 Flash 为不对称激活 MoE,成本远低于同尺寸模型 — gaganghotra_ · 2026-09-10
- 552B只激活8B:DeepSeek V4.1 Flash效率数据曝光 — Scobleizer · 2026-09-10
- DeepSeek V4.1-Flash:KV缓存缩至首代1/437,价格仅为Opus四十分之一 — AdinaYakup · 2026-09-10