DeepSeek-V4-Flash 正式版 API 上线,Agent 能力跃升且价格击穿底线

智东西 · wechat · 2026-07-31

DeepSeek-V4-Flash 正式版 API 开启公测,Pro 正式版将于 8 月初上线。Flash 正式版采用 MoE 架构(总参数 284B,激活 13B),支持 100 万 token 上下文,并原生兼容 OpenAI Responses API 格式。

此次更新的核心亮点在于大幅增强的 Agent 能力,在 TerminalBench、Cybergym 等多项基准测试中成绩远超 4 月的预览版。同时,模型针对长上下文进行了激进的推理与显存优化,在百万 token 场景下计算量与 KV Cache 占用大幅下降。

价格方面,Flash 版输入命中缓存仅 0.2 元/百万 tokens,输出为 2 元/百万 tokens;Pro 版输出则为 24 元/百万 tokens。文章指出,在 OpenAI 等头部厂商跟进降价的大背景下,低廉的 API 调用成本已不再是核心壁垒,模型真正比拼的决赛圈在于其实际的 Agent 交付能力。

所属事件:DeepSeek-V4-Flash 正式版 API 上线,Agent 能力大幅跃升(18 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →