DeepSeek推多模态API,一张图仅384token,价格差竞品25倍
新智元 · wechat · 2026-08-21
DeepSeek 发布首个多模态 API 模型 DeepSeek-V4-Flash-Vision-Exp,支持通过 ChatCompletions、Messages、Responses 格式调用,并配套升级了 Harness 框架。该模型视觉能力强,在七项 Agent 评测中六项超越前代,甚至一度击败硅谷顶级模型。最具杀伤力的是其定价策略:一张图片最多仅占 384 个 token,计费与纯文本模型 V4-Flash 完全一致。按市价对比,处理 1000 张图片的成本最低仅需 1.15 元(谷时),比 Claude、GPT-4o 等竞品便宜 25 至 50 倍。实测显示,该模型能精准理解截图并生成 1:1 复刻的高保真 HTML 代码,也能根据模糊需求生成专业度极高的商业 PPT。
所属事件:DeepSeek 上线 V4-Flash-Vision-Exp 多模态模型(29 条相关)→
「多模态」频道最新
- 主流视觉模型实力分级榜出炉 — andrejusb · 2026-08-23
- Saxxy Harry 吹萨克斯短片,LTX 2.5 制作 — Kyrannio · 2026-08-23
- Seedance 2.5 生成搞笑舞蹈视频,反转结尾 — Kyrannio · 2026-08-23
- AI 视频逼真到令人怀疑人生,引发模型猜测 — Xianbao_QIAN · 2026-08-23
- 电商产品图提示词模板:雕塑感编辑风场景摄影 — azed_ai · 2026-08-23
- VideoCoCo:用可执行代码修复视频生成的物理常识错误 — TinfoilTricorn · 2026-08-23