DeepSeek V4.1-Flash 发布:新架构+大幅降价,输出价格仅 GPT-5.6 Sol 的 6%
kimmonismus · x · 2026-09-10
DeepSeek 发布 V4.1-Flash,距 7 月的 V4-Flash 仅六周,引入全新架构:
- 架构:Causal Encoder–Decoder,原生视觉理解;552B MoE 参数,输入处理激活 8B、输出生成激活 16B。读取大输入更便宜,共享并压缩存储上下文以降低内存需求,特别适合反复读代码/文档/工具结果的 agent。
- 效率:KV-cache 需求降至上一代的 1/4(HBM)与 1/8(SSD)。
- 成绩(DeepSeek 自测):DeepSWE 上 V4.1-Flash 得 74.2%,超上代 54.4% 与 GPT-5.6 Sol 的 73.0%;多个编码与 agent benchmark 追平或超过 GPT-5.6 Sol。
- 价格:较 V4-Flash 再降——新输入 -32%、缓存输入 -57%、输出 -9%。峰值 $1.20/百万输出 token 对 Sol 的 $20(-94%),谷时低至 $0.60。
作者评论:DeepSeek 重启价格战,「这才是真正的护城河」,且行业进入每周都有显著改进的节奏。
所属事件:DeepSeek 发布 V4.1 Flash:新架构原生视觉、MIT 开源(35 条相关)→
「Infra」频道最新
- 一天烧 40 亿 token,14 次按键把账单砍 500 倍,作者担忧 5 万亿美元债务 — gaganghotra_ · 2026-09-10
- DeepSeek 稀疏化新动向:token 效率看齐 OpenAI,告别「胖鲸吃白饭」 — teortaxesTex · 2026-09-10
- Acellera 实测:单张 RTX 5090 跑本地模型做药物发现 — gdefabritiis · 2026-09-10
- Mac mini 实测:35B 本地运行时达 Haiku 水准,但不适合 Agent — PawelHuryn · 2026-09-10
- Miles 为 DeepSeek-V4.1-Flash 提供 Day-0 RL 支持,KL 仅 0.0012–0.0017 — ying11231 · 2026-09-10
- 数据中心是一个符号:拆解反数据中心叙事背后的情绪 — ShakeelHashim · 2026-09-10