DeepSeek 开源 V4 Flash Vision 多模态模型
ccerrato147 · x · 2026-09-01
DeepSeek 发布了 DeepSeek-V4-Flash-Vision-Exp 模型,现已开源。这是一个图像到文本的多模态模型,基于 Transformer 架构。该模型在 Terminal Bench 2.1 上取得了 83.9 分(排名第 8),在 Deep Swe 上取得了 59.3 分(排名第 5)。模型支持 8-bit 和 fp8 量化,采用 MIT 许可证。
所属事件:DeepSeek 悄然开源 V4 系列首款多模态模型(13 条相关)→
「多模态」频道最新
- Kijai 已放出 FastH3 权重,但标准 ComfyUI 工作流还跑不通 — bub000 · 2026-09-01
- 开发者实测称 OpenAI Sol 首个真正「懂音乐」的模型 — evilsocket · 2026-09-01
- 8GB 显存跑 Latentsync 三个月实测:本地「免费」的真实账单 — cloudybrain07 · 2026-09-01
- 用“反向书法”概念生成电影片头 — umesh_ai · 2026-09-01
- 生成艺术探索:手写代码与 AI 生成代码对比 — adamho · 2026-09-01
- SlopTV:基于 YouTube 聊天的无限 AI 视频生成直播流 — InvadersMustLive · 2026-09-01