DeepSeek推多模态API,一张图仅384token,价格差竞品25倍

新智元 · wechat · 2026-08-21

DeepSeek 发布首个多模态 API 模型 DeepSeek-V4-Flash-Vision-Exp,支持通过 ChatCompletions、Messages、Responses 格式调用,并配套升级了 Harness 框架。该模型视觉能力强,在七项 Agent 评测中六项超越前代,甚至一度击败硅谷顶级模型。最具杀伤力的是其定价策略:一张图片最多仅占 384 个 token,计费与纯文本模型 V4-Flash 完全一致。按市价对比,处理 1000 张图片的成本最低仅需 1.15 元(谷时),比 Claude、GPT-4o 等竞品便宜 25 至 50 倍。实测显示,该模型能精准理解截图并生成 1:1 复刻的高保真 HTML 代码,也能根据模糊需求生成专业度极高的商业 PPT。

所属事件:DeepSeek 上线 V4-Flash-Vision-Exp 多模态模型(29 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →