DeepSeek V4.1-Flash 发布:552B MoE 宣称全面超越 V4-Pro
eyishazyer · x · 2026-09-11
DeepSeek 于 9 月 10 日正式发布 V4.1-Flash(区别于两天前泄露的测试版):
- 架构:552B 参数 MoE,采用新的因果编码器-解码器分离,输入仅 8B 激活参数、输出 16B。
- 效率:官方称 KV cache 的 HBM 占用为上一代的 1/4,SSD 占用为 1/8。
- 性能宣称:V4.1-Flash 在性能、成本、速度与总运行时长上全面超越 V4-Pro,力度大到所有 V4-Pro API 流量将从 9 月 14 日起切换至 Flash。
- 价格:据 TechNode 转述的通知,非高峰时段 cache 命中输入 token 价格将降至约每百万 token 人民币 0.02 元,但截至发稿 DeepSeek 官方定价页尚未确认该价格。
所属事件:DeepSeek 开源发布 V4.1 Flash:552B MoE 新架构低价超越自家旗舰(52 条相关)→
「Infra」频道最新
- Agents API 支持自带沙箱,预集成 Cloudflare、Modal、Vercel 等九家 — OpenAIDevs · 2026-09-11
- 单张 RTX 3090 训 8 天:GPT-2 改造 MoE 从零训练成功 — rasbt · 2026-09-11
- B3IQ 两周卖出八位数 GPU,称 AI 基建是千亿美元机会 — templecrash · 2026-09-11
- 装个免费软件花掉 100 美元 API 费,agent 成本吐槽引共鸣 — MartinGTobias · 2026-09-11
- bartowski 为 GGUF 量化模型设计新张量布局,测试全面优于旧版 — noneabove1182 · 2026-09-11
- antirez 在 128GB M5 Max 上跑 DeepSeek v4.1 Flash,SSD 流式加载快得出乎意料 — antirez · 2026-09-11