DeepSeek V4.1 Flash 以 552B 参数反超 1.6T 旗舰,价格便宜 4 倍
ArtificialAnlys · x · 2026-09-11
DeepSeek 发布 V4.1 Flash,取代 V4 Pro 0813 成为新旗舰,在 Artificial Analysis Intelligence Index 得分 40,超过自家的 1.6T Pro 模型,而 token 价格便宜约 4 倍。
架构与定价
- 552B 参数的全新因果 Encoder–Decoder 架构,输入仅激活 8B、输出激活 16B 参数
- 1M token 上下文窗口
- 官方 API:输入 $0.30/1M、输出 $1.20/1M,缓存输入低至 $0.006/1M(98% 折扣),错峰再打五折;比 V4 Flash 0731 便宜约 20%
评测亮点
- Terminal-Bench v4.0 得分 27%,是上代 Flash 的两倍以上
- GDPval-AA v2 升 164 Elo 至 1632,超过 Kimi K3(1584)
- AA-LCR v1.1 达 84%,与 GPT-5.6 Sol、Gemini 3.8 Flash 持平,长文档/大仓库任务表现突出
- AutomationBench-AA 拿下第一(69%),与 GPT-6 Astra 持平,超 Grok 4.6(67%)和 GLM-5.3(62%)
短板:极长输出
- 每个 Index 任务平均输出 89k token,比 GLM-5.3 多 25%,比自家 Pro 多 62%,甚至超过 Fable 5.1 和 Claude Opus 5
- 即便如此,每任务成本仅 $0.27,约为 GLM-5.3 和 Kimi K3 的 1/7,略逊于成本 Pareto 前沿
总体看:agentic 与长上下文能力大幅提升,flash 档定价极其激进,但输出冗长是需要权衡的代价。
所属事件:DeepSeek 开源发布 V4.1 Flash:552B MoE 低价反超旗舰(56 条相关)→
「模型」频道最新
- Hume 语音克隆排行榜:最自然的克隆听感仅排第 8 — realmrfakename · 2026-09-11
- OpenAI 暂停 200 美元套餐注册:饥饿营销还是算力见底? — andrew_n_carr · 2026-09-11
- CursorBench 4.0 发布:任务更难更长程,各家模型得分集体下降 — StringChaos · 2026-09-11
- 开发者实测称 Astra 是个好模型 — jxnlco · 2026-09-11
- 新模型跑分「离谱」:效率直逼 Sol/Opus 水平,RL 基建细节曝光 — nrehiew_ · 2026-09-11
- DeepSeek V4.1 Flash 技术深读:死磕 KV cache 压缩造就高效前沿模型 — nrehiew_ · 2026-09-11