DeepSeek 发布 V4.1 Flash:552B MoE 超旗舰,降价并下线 V4 Pro
DeepSeek · wechat · 2026-09-10
DeepSeek 官宣 V4.1 Flash,新架构系列最小模型:552B 参数 MoE,采用全新 Causal-Encoder-Decoder 非对称结构,输入激活仅 8B、输出 16B,原生多模态视觉理解。
- 基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型,计划有序下线 V4 Pro;9 月 14 日起访问 deepseek-v4-pro 将路由至 V4.1 Flash 并按其计费。
- KV Cache 相比上一代缩小 4 倍(HBM 需求 1/4、SSD 1/8),相对初代累计缩小 437 倍,大幅降低 Agent 场景缓存成本。
- API 已上线,模型名 deepseek-flash 即可调用;9 月 10 日起新定价生效,保留峰谷定价,闲时半价。
- 腾讯 WorkBuddy、CodeBuddy 与 OpenCode 为官方合作伙伴已全量接入;模型 MIT 开源,附技术报告,大规模部署(2k 卡 GPU+存储集群)可联系官方。
所属事件:DeepSeek开源V4.1-Flash:新架构原生视觉MIT协议(29 条相关)→
「Infra」频道最新
- Kimi K3 上线 RunPod:2.8T 参数、1M 上下文,$3/$15 定价 — Kimi_Moonshot · 2026-09-10
- 一周烧掉3亿 token 仍未触顶,GLM 5.3 额度宽松引热议 — saibharadwaj · 2026-09-10
- Nvidia 收购 Hugging Face 后,业界呼吁建设中立替代平台 — hargup13 · 2026-09-10
- 5 小时被扣 8.2 万美元账单:Google Cloud 用户遭天价扣费 — Patient_Election2179 · 2026-09-10
- TRL 发布百万 token 长上下文训练指南,单节点训通 Qwen3-8B — QGallouedec · 2026-09-10
- 双 RTX Pro 6000 + Threadripper 9955W 本地跑大模型,配置求把关 — No_Run8812 · 2026-09-10