DeepSeek 终于睁开眼:V4-Flash-Vision 上线,看图约一分钱九张
量子位 · wechat · 2026-08-22
等了四个月,DeepSeek 发布多模态实验模型 deepseek-v4-flash-vision-exp,原生支持图片输入(不含图片生成),已上线 API,计费与 Flash 一致,一张图最多占 384 tokens,「高峰+缓存未命中」下约 0.12 分钱看一张,1 分钱约看 9 张,远低于某竞品的 2 分/张。
量子位实测:纯文本能力(Agent、推理、世界知识)与 V4 Flash 持平,但在需要多模态的 Agent Benchmark 上较 V4 Flash 大幅跃升,接近 Opus-4.8;基础识图与内测网页版体验相当。搭配 DeepSeekHarness(同日更新,原生支持第一方多模态模型)实测照图建模、Canvas 手绘 demo 效果不错,但数手指仍是通病。文中还提到 X 上爆火的「牛来」模型,最多猜测指向智谱。
所属事件:DeepSeek 上线 V4-Flash-Vision-Exp,多模态 Agent 逼近 Opus 4.8(26 条相关)→
「模型」频道最新
- Qwen 3.8 低推理模式实测:循环次数显著减少 — Lair98 · 2026-08-22
- GLM-5.3 摘得创意写作基准亚军,定性分析报告发布 — zero0_one1 · 2026-08-22
- 私下基准测试:0x Alpha 低推理配置表现不佳 — toptickcrypto · 2026-08-22
- Ox Alpha 模型实测:代码与数据分析能力超预期 — killerbee1432 · 2026-08-22
- Qwen3.8-27B 优化:长上下文解码提速 3 倍 — stargate425 · 2026-08-22
- Grok 4.6 登顶 CursorBench,成本仅为竞品 1/6 — XFreeze · 2026-08-22