专题 · FULL STORY
DeepSeek V4-Flash-Vision:上线与实测
8 月 21 日,DeepSeek 在官方 API 平台上线实验性多模态视觉模型 V4-Flash-Vision-Exp,引发广泛关注;随后用户实测其视觉生成能力,在相同提示词与参考图下成功生成动态视觉内容,讨论持续升温。
2026-08-21 ~ 2026-08-23 · 2 集 · 31 条
第 1 集 · DeepSeek 上线 V4-Flash-Vision-Exp 多模态模型(2026-08-21,29 条)
8 月 21 日,DeepSeek 在官方 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp(官方账号 @deepseekai 发布)。该模型纯文本能力与 V4-Flash 持平,覆盖 agents、推理与世界知识;在多模态 agent 基准上较 V4-Flash 大幅跃升,官方称接近 Anthropic Opus 4.8。以 Flash 级定价提供接近头部的多模态 agent 能力,是 DeepSeek 向多模态与 agent 方向扩展的标志性动作。
已确认
- 模型已在 DeepSeek API 平台上线,属实验性质,原生支持图片输入(不含图片生成),支持真正的图片输入而非仅 OCR。
- 纯文本能力与 V4-Flash 持平;多模态 agent 基准性能大幅提升,接近 Opus 4.8。据 @卡尔的AI沃茨,其编码能力较 flash 版本亦有提升。
- API 细节:调用 model='deepseek-v4-flash-vision-exp',支持 Chat Completions、Messages 与 Responses 接口,支持图文混合输入;每张图片消耗 117-384 tokens,按 V4-Flash 价格计费。据 @量子位 测算,高峰加缓存场景下「约一分钱九张图」(该说法未在本簇帖中直接出现,以官方 token 消耗为准)。
- 据 @petrusenkomax 梳理,图像支持三种输入方式:inline 发送 JPEG/PNG/GIF/WebP(上限 48 MiB)、URL(上限 32 MiB)、Files API 引用。据 @aigclink 发布的 API 文档,模型支持图片描述、文字识别(OCR)及图表分析等功能。
- 据 @heypearlai 报道,Files API 同步发布,支持上传图片后通过对话调用,且免费开放;@新智元 与 @卡尔的AI沃茨 提到配套升级 Harness 框架以支持图文输入与文件引用;@新智元 称与竞品价格差距可达 25 倍(该倍数为媒体说法,未见于官方帖)。
- 官方补充说明该模型可在各类 agent 框架中顺畅工作,可将视觉理解与多种工具组合,构建多模态 agent 工作流。
- 用户 @teortaxesTex 实测认为其推理速度极快,图像理解能力未必最强,但速度和成本优势显著,可能再次冲击推理市场。
为什么重要
- 以 Flash 级模型在多模态 agent 基准上逼近头部闭源模型 Opus 4.8,延续 DeepSeek 的性价比路线,直接瞄准低价高速推理市场。
- 跨 agent 框架兼容与配套 Harness、Files API(免费)更新意味着开发者可在现有工作流中直接接入视觉能力,降低多模态应用门槛。
- DeepSeek发布V4-Flash多模态模型,Agent能力接近Opus-4.8 — DeepSeek · 2026-08-21
- DeepSeek 多模态版发布,视觉 Agent 能力接近 Opus-4.8 — 赛博禅心 · 2026-08-21
- DeepSeek 发布 V4-Flash-Vision-Exp,多模态 Agent 能力逼近 Opus 4.8 — deepseek_ai · 2026-08-21
- DeepSeek:V4-Flash-Vision-Exp 可跨 agent 框架流畅调用 — deepseek_ai · 2026-08-21
- DeepSeek Vision API 细节:每图最多 384 tokens,按 V4-Flash 价计费 — deepseek_ai · 2026-08-21
- DeepSeek V4 视觉模型上线,主打极速与低价 — teortaxesTex · 2026-08-21
- DeepSeek 推出 V4-vision-exp:极速且低成本 — teortaxesTex · 2026-08-21
- Deepseek发布多模态模型V4FlashVisionEXP — 歸藏的AI工具箱 · 2026-08-21
- DeepSeek V4 Flash 新增视觉能力,现已上线 — TheCryptoCat75 · 2026-08-21
- DeepSeek 推出 V4 多模态实验版,代理能力逼近 Opus-4.8 — teortaxesTex · 2026-08-21
- DeepSeek 上线多模态 Agent 模型 V4-Flash-Vision,Files API 同步发布 — APPSO · 2026-08-21
- DeepSeek 上线多模态模型 V4-Flash-Vision-Exp — 智东西 · 2026-08-21
- DeepSeek 推出 V4-Flash-Vision-Exp:多模态 Agent 跃升 — eyishazyer · 2026-08-21
- DeepSeek 发布 V4-Flash-Vision-Exp 实验多模态模型 — cedric_chee · 2026-08-21
- DeepSeek推多模态API,一张图仅384token,价格差竞品25倍 — 新智元 · 2026-08-21
- DeepSeek 上线多模态视觉模型,对标 Claude Opus — 机器之心 · 2026-08-21
- DeepSeek 发布 V4 Flash Vision 图像理解 API — aigclink · 2026-08-21
- DeepSeek 推出 V4-Flash 视觉模型,支持多模态代理 — AI寒武纪 · 2026-08-21
- DeepSeek 发布多模态模型,OpenAI 开源 Codex 平台 — 卡尔的AI沃茨 · 2026-08-21
- DeepSeek 推出多模态实验模型,文件 API 免费开放 — heypearlai · 2026-08-21
第 2 集 · DeepSeek 视觉生成模型实测引热议(2026-08-23,2 条)
用户实测 DeepSeek-V4-Flash-Vision-EXP 模型的视觉生成能力,在相同提示词和参考图条件下成功生成视觉内容,演示链接显示结果甚至可以是动态的。另有对比测试将 Ox Alpha、DeepSeek V4 Flash、Vision EXP 与 Claude Fable 5 放在一起评估,结果显示 Claude Fable 5 在排版细节方面表现更优,引发社区对多模态模型生成能力的关注。
- DeepSeek-V4-Flash-Vision-EXP 生成动态图实测 — op7418 · 2026-08-23
- 多模态模型实测:Claude Fable 5 排版细节更优 — op7418 · 2026-08-23