DeepSeek 终于睁开眼:V4-Flash-Vision 上线,看图约一分钱九张

量子位 · wechat · 2026-08-22

等了四个月,DeepSeek 发布多模态实验模型 deepseek-v4-flash-vision-exp,原生支持图片输入(不含图片生成),已上线 API,计费与 Flash 一致,一张图最多占 384 tokens,「高峰+缓存未命中」下约 0.12 分钱看一张,1 分钱约看 9 张,远低于某竞品的 2 分/张。

量子位实测:纯文本能力(Agent、推理、世界知识)与 V4 Flash 持平,但在需要多模态的 Agent Benchmark 上较 V4 Flash 大幅跃升,接近 Opus-4.8;基础识图与内测网页版体验相当。搭配 DeepSeekHarness(同日更新,原生支持第一方多模态模型)实测照图建模、Canvas 手绘 demo 效果不错,但数手指仍是通病。文中还提到 X 上爆火的「牛来」模型,最多猜测指向智谱。

所属事件:DeepSeek 上线 V4-Flash-Vision-Exp,多模态 Agent 逼近 Opus 4.8(26 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →