DeepSeek-V4-Flash 正式版 API 上线,Agent 能力跃升且价格击穿底线
智东西 · wechat · 2026-07-31
DeepSeek-V4-Flash 正式版 API 开启公测,Pro 正式版将于 8 月初上线。Flash 正式版采用 MoE 架构(总参数 284B,激活 13B),支持 100 万 token 上下文,并原生兼容 OpenAI Responses API 格式。
此次更新的核心亮点在于大幅增强的 Agent 能力,在 TerminalBench、Cybergym 等多项基准测试中成绩远超 4 月的预览版。同时,模型针对长上下文进行了激进的推理与显存优化,在百万 token 场景下计算量与 KV Cache 占用大幅下降。
价格方面,Flash 版输入命中缓存仅 0.2 元/百万 tokens,输出为 2 元/百万 tokens;Pro 版输出则为 24 元/百万 tokens。文章指出,在 OpenAI 等头部厂商跟进降价的大背景下,低廉的 API 调用成本已不再是核心壁垒,模型真正比拼的决赛圈在于其实际的 Agent 交付能力。
所属事件:DeepSeek-V4-Flash 正式版 API 上线,Agent 能力大幅跃升(18 条相关)→
「编程与Agent」频道最新
- Flask之父感叹AI正重塑前端:连布局引擎都能自动生成 — mitsuhiko · 2026-07-31
- Claude Opus 完美重塑 3D 版《宝可梦》 — DanielLockyer · 2026-07-31
- AI 编程进化史:从替代恐慌到拒绝人类代码 — kevinnbass · 2026-07-31
- 浏览器智能体如何安全接管Chrome?开源项目Panerelay提出细粒度权限隔离 — Potential_Fee3513 · 2026-07-31
- AI Agent 一键改编视频,20天社媒内容全自动分发 — heyshrutimishra · 2026-07-31
- 吐槽Codex额度消耗极快,开发者寻求高性价比AI编程工具 — Feeling_Peanut5274 · 2026-07-31