DeepSeek 发布 V4.1-Flash:多模态 MoE、百万上下文

DeepSeek 官方发布新架构家族中最小成员 V4.1-Flash,为 552B 骨干参数(总参数标注 763B)的多模态 MoE 模型,原生支持图文输入,主打编码与智能体场景,上下文最长约 100 万 token,KV 缓存缩小 4 倍,建站成本据称仅为 Claude 的 1/40。该模型已上线 Fireworks、FLock API 平台,并可在 Ollama 以云端模式运行,多平台快速铺开。

2026-09-11 ~ 2026-09-12 · 5 条相关

事件全程(共 18 集)→