DeepSeek 发布 V4.1-Flash,支持百万上下文
DeepSeek 官方发布新架构家族中最小成员 V4.1-Flash,面向 agentic 与长上下文场景,支持最长 100 万 token 上下文,并将 KV 缓存缩小 4 倍。该模型为多模态 MoE 架构,552B 骨干参数、总参数约 763B,现已上线 FLock API 平台,并可在 Ollama 上以云端模式运行。
2026-09-11 ~ 2026-09-11 · 2 条相关
- 第 1 集:DeepSeek V4.1 Flash 限时内测:新架构原生多模态(2026-09-08,18 条)
- 第 2 集:DeepSeek V4.1 Flash实测:极速350 tokens/s但偏实验性(2026-09-08,2 条)
- 第 3 集:DeepSeek V4-Flash 降价并改峰谷计费,9 月 10 日生效(2026-09-08,6 条)
- 第 4 集:DeepSeek V4.1 Flash 多方实测:近前沿性能,成本仅 1.4%~3.5%(2026-09-09,15 条)
- 第 5 集:DeepSeek 开源发布 V4.1 Flash,超旗舰低价引热议(2026-09-09,57 条)
- 第 6 集:DeepSeek V4.1 Flash 爆料:552B 非对称架构对标 GPT-5.6(2026-09-10,20 条)
- 第 7 集:DeepSeek V4.1 Flash 评测跑分流出,社区热议实测表现(2026-09-10,2 条)
- 第 8 集:DeepSeek 九个月将 KV 缓存压缩 54 倍至亚 KB 水平(2026-09-10,6 条)
- 第 9 集:传 DeepSeek 新模型成开源之王:碾压 GLM、Kimi 且便宜 4-10 倍(2026-09-10,3 条)
- 第 10 集:Bug Hunt Bench:105 个真实 bug 实测前沿模型修 Bug 能力(2026-09-10,8 条)
- 第 11 集:DeepSeek V4.1 Flash 确认以 YOCO 为灵魂(2026-09-10,7 条)
- 第 12 集:DeepSeek V4.1 Flash 技术报告流出:全链路死磕 KV cache 压缩(2026-09-11,42 条)
- 第 13 集:DeepSeek V4.1 Flash 登顶 Vals 开源榜,成本仅 0.3 美元(2026-09-11,2 条)
- 第 14 集:DeepSeek V4.1 Flash 评测得 40 分,幻觉率上升仍领先开源(2026-09-11,2 条)
- 第 15 集:DeepSeek CED 与 GLM 的 KV 缓存复用机制解析(2026-09-11,4 条)
- 第 16 集:DeepSeek 发布 V4.1-Flash,支持百万上下文(2026-09-11,2 条)
- DeepSeek-V4.1-Flash 登陆 Ollama:763B MoE、1M 上下文,主打 KV cache 压缩 — ollama · 2026-09-11
- DeepSeek 发布 V4.1-Flash:百万 token 上下文,KV 缓存缩小 4 倍 — matlabulous · 2026-09-11