DeepSeek 发布 V4.1-Flash,支持百万上下文

DeepSeek 官方发布新架构家族中最小成员 V4.1-Flash,面向 agentic 与长上下文场景,支持最长 100 万 token 上下文,并将 KV 缓存缩小 4 倍。该模型为多模态 MoE 架构,552B 骨干参数、总参数约 763B,现已上线 FLock API 平台,并可在 Ollama 上以云端模式运行。

2026-09-11 ~ 2026-09-11 · 2 条相关

事件全程(共 16 集)→