DeepSeek 发布 V4.1-Flash:新架构家族最小模型,原生视觉理解
teortaxesTex · x · 2026-09-10
DeepSeek 官方宣布推出 DeepSeek-V4.1-Flash,定位为更快、更高效的新模型。要点:
- 新架构家族中尺寸最小的模型,首次原生支持视觉理解
- 设计目标为更强能力、更快推理与更高吞吐,并可向更大规模模型扩展
- 网友戏称这是让「encoder-decoder」架构复兴的信号
目前官方仅发布预告性质的介绍帖,详细技术报告与评测数据待后续放出。
所属事件:DeepSeek 发布 V4.1-Flash:552B MoE 原生视觉,MIT 开源(23 条相关)→
「模型」频道最新
- DeepSeek 新开源模型实测碾压 GLM 与 Kimi,便宜 4-10 倍 — deedydas · 2026-09-10
- Flash 小版本更新反超上代 Pro,DeepSeek 被劝专注小模型推理 — zephyr_z9 · 2026-09-10
- 截图显示 V4 时代 KV cache 机制存在 72 小时限制 — zephyr_z9 · 2026-09-10
- 用户称 OpenAI 叫停其蛋白质设计项目,转投开源权重模型 — Terminator857 · 2026-09-10
- 同一模型不同评测框架成绩悬殊,开发者呼吁标准化 harness 评测 — zainhas · 2026-09-10
- DeepSeek V4.1 Flash 实测:推理力度与输出质量近似线性扩展 — zainhas · 2026-09-10