DeepSeek 发布 V4.1-Flash:552B MoE 仅 8B 激活,KV 缓存缩至 1/4
thione · x · 2026-09-21
DeepSeek 发布新架构家族中最小的模型 DeepSeek-V4.1-Flash:552B 参数 MoE,采用非对称 Causal Encoder–Decoder 架构,输入仅激活 8B 参数、输出 16B,带原生多模态视觉理解。
关键点:
- KV 缓存需求大幅压缩:HBM 只需上代 1/4,SSD 存储只需 1/8,显著降低智能体场景的缓存命中成本;
- 新预训练方法加更大规模 RL 后训练,官方称基准成绩超过旗舰 V4-Pro,并将逐步淘汰 V4-Pro(9 月 14 日起所有 v4-pro 请求按 V4.1-Flash 路由);
- API 已上线(deepseek-flash),谷峰定价:谷峰费率为峰值的 50%;
- 合作伙伴 WorkBuddy(含 CodeBuddy)与 OpenCode 已全面支持。
所属事件:DeepSeek 发布 V4.1-Flash:552B MoE 架构为 Agent 重构(3 条相关)→
「Infra」频道最新
- Meta 携手 Arm 开发新一代数据中心 CPU「Arm AGI CPU」 — bookwormengr · 2026-09-21
- Starlink 席卷拉美农村教育:数万座天线连接数十万学生 — XFreeze · 2026-09-21
- HF speech-to-speech 合入 NVIDIA Parakeet Unified 语音识别后端 — andimarafioti · 2026-09-21
- 苹果赢下 AI 算力彩票:M5 Ultra 512GB 统一内存成本地跑模型利器 — Hesamation · 2026-09-21
- 骁龙 8 Elite 手机本地跑 Z Image Turbo,40 秒一张图 — Fine_Philosopher_882 · 2026-09-21
- 8GB 内存也能跑 LLM:Linux 轻量开发实力打脸质疑 — gnukeith · 2026-09-21