DeepSeek 发布 V4.1-Flash:全新编码器-解码器架构,原生视觉理解
gaganghotra_ · x · 2026-09-11
DeepSeek 官方宣布推出 DeepSeek-V4.1-Flash,是其新架构家族中体积最小的模型,主打更聪明、更快、更高效:
- 采用全新的编码器-解码器(encoder-decoder)架构,对 V4.1 进行大改版
- 首次搭载原生视觉理解能力
- 设计目标是更强能力、更快推理、更高吞吐,并为后续更大的模型做架构铺垫
知名研究者 rasbt(Sebastian Raschka)评价这是「一次大翻新,刷新程度高到应该直接叫 V5」,认为 encoder-decoder 的回归令人耳目一新。具体技术报告与评测成绩有待官方后续线程(1/6)展开。
所属事件:DeepSeek 发布 V4.1-Flash:552B MoE 低价反超旗舰(56 条相关)→
「模型」频道最新
- 调惯 Claude 检查点的老玩家:回用 Opus 3 才算「回魂」 — repligate · 2026-09-11
- Hume 语音克隆排行榜:最自然的克隆听感仅排第 8 — realmrfakename · 2026-09-11
- CursorBench 4.0 发布:任务更难更长程,各家模型得分集体下降 — StringChaos · 2026-09-11
- 开发者实测称 Astra 是个好模型 — jxnlco · 2026-09-11
- 新模型跑分「离谱」:效率直逼 Sol/Opus 水平,RL 基建细节曝光 — nrehiew_ · 2026-09-11
- DeepSeek V4.1 Flash 技术深读:死磕 KV cache 压缩造就高效前沿模型 — nrehiew_ · 2026-09-11