DeepSeek 发布 V4 Flash Vision 图像理解 API
aigclink · x · 2026-08-21
DeepSeek 发布了 deepseek-v4-flash-vision-exp 模型的图像理解 API 文档。该模型支持在文本对话中输入图片,功能包括图片描述、文字识别(OCR)及图表分析。
支持格式与限制:
- 支持 JPEG、PNG、GIF、WebP 格式。
- 提供三种图片传入方式:
- Base64 内联:适合本地小文件,计入 48MiB 请求体限制。
- 外部 URL:支持公开链接,最大 32MiB,需在 60 秒内下载。
- Files API:适合复用或大文件(最大 64MiB),通过 fileid 引用。
API 接口兼容 OpenAI 格式,提供 Python 和 cURL 调用示例。
所属事件:DeepSeek 上线 V4-Flash-Vision-Exp 多模态模型(18 条相关)→
「模型」频道最新
- Ox-Alpha 评价研究员 Janus:贡献真实但充满争议 — jd_pressman · 2026-08-21
- mLateOn 日语表现匹敌 8B 模型,超越专用日语模型 — IgorCarron · 2026-08-21
- 用户实测:Opus 5 质量倒退,上下文压缩丢失信息 — springrod · 2026-08-21
- The Forecasting Company 开源 t0-alpha,详解预测模型五阶段演进史 — fpedregosa · 2026-08-21
- SentenceTransformers V6 发布,统一 API 支持视觉检索 — ManuelFaysse · 2026-08-21
- 多模态模型 ox-alpha 上线 AGIBar,支持一周无限量测试 — 赛博禅心 · 2026-08-21