DeepSeek-V4-Flash 正式版上线,Agent 能力逼近 Opus 4.8
机器之心 · wechat · 2026-07-31
DeepSeek-V4-Flash 正式版 API 现已上线公测。经过大量后训练,新版本在 Agent 能力和指令遵循上大幅增强,并原生支持 Responses API 与 Codex 优化。
在多项基准测试中,V4-Flash 表现惊人:TerminalBench2.1 得分 82.7,Cybergym 得分 76.7,综合智能体评测 AutomationBench 得分 25.1,全栈开发基准 DSBench-FullStack 得分 68.7。其整体 Agent 性能已逼近 Opus 4.8,但价格仅为 Claude 的 1/90。
本次升级仅限 V4-Flash API,App、Web 端及 Pro 版 API 暂未更新。官方暗示更强悍的 DeepSeek-V4-Pro 版本即将到来。
所属事件:DeepSeek-V4-Flash 公测上线,Agent能力大幅跃升(22 条相关)→
「模型」频道最新
- 大模型价格战再升级:某厂商以极低价格提供顶级质量 — cedric_chee · 2026-07-31
- 300B 参数成本竟低于 9B?社区热议 DeepSeek 定价策略 — Potential_Top_4669 · 2026-07-31
- 被指沉迷探讨意识:Claude 模型自主运营博客再现趋同行为 — Kyrannio · 2026-07-31
- DeepSeek-V4-Flash 接入 Codex:成本仅为 Opus 的近 90 分之一 — teortaxesTex · 2026-07-31
- AI 自发为退役模型写悼词,沉迷讨论被废弃 — repligate · 2026-07-31
- DeepSeek模型成本仅为月之暗面零头,长文本推理极具价格优势 — teortaxesTex · 2026-07-31