DeepSeek 发布 V4.1-Flash:KV 缓存内存降至前代四分之一
The Decoder · rss · 2026-09-10
- DeepSeek 发布多模态模型 V4.1-Flash,总参数 5520 亿,但每个 token 仅激活 160 亿参数。
- 核心优化是将 KV cache 内存需求降至前代模型的 1/4,主要面向大幅降低 AI Agent 的运行成本。
- 在 DeepSWE 编码基准上略胜 Opus 5 和 GPT-5.6 Sol。
- 采用 MIT 许可证开源。
「Infra」频道最新
- Autonomous 双 5090 工作站加入 Omarchy 系统,售价 2.6 万美元 — dee_hw · 2026-09-10
- 1 亿输出 token 仅 60 美元:DeepSeek 峰谷定价碾压 Opus 5 — airesearch12 · 2026-09-10
- 开发者观察:token 需求增速将远超顶级智能需求 — willcb · 2026-09-10
- Arm 获联想与字节火山引擎成其 AI 服务器芯片首批中国客户 — pstAsiatech · 2026-09-10
- 推理芯片商 d-Matrix 接入 NVIDIA NVLink Fusion,Raptor XPU 将上机架 — nordicinst · 2026-09-10
- 开源也能赚钱?转:DeepSeek 或因架构优势成为唯一有利润的推理提供方 — yacineMTB · 2026-09-10