DeepSeek发布V4-Flash多模态模型,Agent能力接近Opus-4.8
DeepSeek · wechat · 2026-08-21
DeepSeek 上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp。在纯文本能力上与正式版 V4-Flash 持平,但在视觉理解相关的 Agent 基准测试中实现大幅跃升,能力已接近 Opus-4.8。
该模型在 Agent 框架下展现出较好的多模态适配能力,可支持生成商业定制 PPT、网站二次创作及动态特效前端 Demo 等复杂工作流。
API 方面,图片按 token 计费(最多 384 tokens),价格与 V4-Flash 一致,支持 ChatCompletions 等三种格式及多种图片传入方式。同时,免费的 FilesAPI 现已开放,支持上传图片后通过 fileid 复用。
所属事件:DeepSeek 上线 V4-Flash-Vision-Exp,多模态 Agent 逼近 Opus 4.8(12 条相关)→
「模型」频道最新
- 某小模型被指达 Opus 4.8 水平,Anthropic 需警惕 — kimmonismus · 2026-08-21
- Grok 昨日出现乱码,或因测试 4.6 版 — mark_k · 2026-08-21
- Ornith-1.5-35B-A3B 实测:每秒 250 token — koloved · 2026-08-21
- API 模型迎来视觉能力,多模态功能正式上线 — teortaxesTex · 2026-08-21
- Anthropic 过度信任 Claude 的自我辩解,专家质疑 — GarrisonLovely · 2026-08-21
- 德语用户吐槽LLM德文输出油腻得像总理 — DominiqueCAPaul · 2026-08-21