DeepSeek 发布 V4.1-Flash:KV 压缩至 890 字节/Token,支持百万上下文

deepseek-ai · hf · 2026-09-18

DeepSeek 发布 DeepSeek-V4.1-Flash,一个面向长程 Agent 工作负载的多模态 MoE 模型,骨干 552B 参数,上下文最高 100 万 token,权重已在 Hugging Face 开放。

所属事件:DeepSeek 发布 V4.1-Flash,552B MoE 支持百万上下文(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →