DeepSeek V4.1-Flash 发布:552B MoE 仅激活 8-16B,内存省 3/4
mark_k · x · 2026-09-11
DeepSeek 发布 DeepSeek-V4.1-Flash,新架构家族中的最小模型,官方称在性能、成本和速度上全面超越此前的 V4-Pro,已上线 API 并开源到 Hugging Face,9 月 14 日起 V4-Pro 请求切换至新模型,后续还有 V4.1-Pro。
关键规格与效率:
- 552B 参数 MoE 架构,输入处理仅激活 8B、输出 16B
- 原生视觉理解
- KV cache 仅需上一代 1/4 的 GPU 显存和 1/8 的 SSD 存储,对长任务 agent 尤其关键
markk 感叹:这只是家族中最小的模型,更大的 V4.1-Pro 值得期待。
所属事件:DeepSeek 开源 V4.1 Flash:552B MoE 小激活量跑分胜旗舰(50 条相关)→
「Infra」频道最新
- Positron AI 融资 2.3 亿美元估值破十亿,Arm 参投 — seanmcdonaldxyz · 2026-09-11
- 推理提速改变 Agent 工作流:Cerebras 实测并行代理更少、产出不降 — MatthewBerman · 2026-09-11
- Baseten 收购 Blaxel,押注下一代智能体基础设施 — baseten · 2026-09-11
- 超大规模厂商有能力分解 RSA-1024,单个成本约 3000 万美元 — rickasaurus · 2026-09-11
- 高通新 Hexagon NPU:共享内存增大 50%,手机可跑 30B MoE 模型 — ryanshrout · 2026-09-11
- Vercel CDN 每秒 8000 万次路由决策,P99 延迟砍掉 91% — cramforce · 2026-09-11