DeepSeek 发布 V4.1-Flash:新架构家族最小模型原生视觉
DeepSeek 官宣 V4.1-Flash,为新架构家族中最小的模型,具备原生视觉理解能力,定位更高能力、更快推理、更高吞吐,并为家族后续更大模型铺路。该模型已上线 Nebius Token Factory,采用 552B 参数的 MoE 架构,每次仅激活 8B,原生支持图像理解,配备 1M 上下文,专为长输入、高吞吐工作流设计。
2026-09-18 ~ 2026-09-18 · 2 条相关
- DeepSeek V4.1 Flash 上线 Nebius:552B MoE 仅激活 8B,配 1M 上下文 — Arindam_1729 · 2026-09-18
- DeepSeek 发布 V4.1-Flash:新架构家族最小模型,原生视觉理解 — aziz4ai · 2026-09-18