DeepSeek 发布 V4.1-Flash:552B MoE 架构为 Agent 重构
DeepSeek 发布新架构家族中最小的模型 V4.1-Flash:552B 参数 MoE、仅 8B 激活,采用非对称 Causal Encoder–Decoder 架构。该模型针对 agent 类工作负载重新设计 Transformer,应对编码、研究、工具调用等 agent 反复处理数十万 token 的场景,KV 缓存被压缩至每 token 890 字节、缩至原来的约四分之一。另有汇总帖称 Google 同期发布 Gemini 3.8 Live(未经官方核实)。
2026-09-21 ~ 2026-09-21 · 3 条相关
- DeepSeek-V4.1-Flash 重构架构:KV 缓存压缩至每 token 890 字节 — AndLukyane · 2026-09-21
- 汇总帖称 Google 发布 Gemini 3.8 Live,DeepSeek 推出 V4.1-Flash — thione · 2026-09-21
- DeepSeek 发布 V4.1-Flash:552B MoE 仅 8B 激活,KV 缓存缩至 1/4 — thione · 2026-09-21