DeepSeek V4.1 Flash 上线 Nebius:552B MoE 仅激活 8B,配 1M 上下文
Arindam_1729 · x · 2026-09-18
- DeepSeek-V4.1-Flash 现已上线 Nebius Token Factory,原生支持图像理解,专为长输入、高吞吐工作流设计。
- 架构为 552B MoE:输入仅激活 8B 参数、输出激活 16B,支持 1M token 上下文。
- 开发者 Arindam 用它做了个实时摄像头小应用:抓取多帧画面让模型总结所见,实测运行流畅,小模型表现出乎意料地好。
所属事件:DeepSeek 发布 V4.1-Flash:新架构家族最小模型原生视觉(2 条相关)→
「模型」频道最新
- 自称 ChatGPT 联合发明者隐身两年,发布「决策专用」新模型 Jev — threepointone · 2026-09-18
- 自称数据研究实验室:全部训练数据 100% 合成造出认知核心 — sh_reya · 2026-09-18
- Benchmark Heaven 上线:聚合 100 项基准、800 个模型,首创 Benchmaxxing 分数 — airesearch12 · 2026-09-18
- 法律 AI 公司 Legora:没有最好的模型,只有每项任务跑分胜出者 — soleio · 2026-09-18
- OpenAI 发布模型失调披露框架,并公开六份失调行为报告 — coherence · 2026-09-18
- 解读 GPT-6 Astra:Stargate 超 10 万 GPU 预训练,押注 3D 具身智能 — udmrzn · 2026-09-18