DeepSeek-V4-Flash-0731 突袭开源,主打百万级上下文
7月31日,DeepSeek 在 Hugging Face 上突袭发布了最新模型 DeepSeek-V4-Flash-0731 的权重及技术报告。该模型主打百万级 token 上下文智能,实测性能表现出色,引发社区高度关注。
已确认
- 要点 模型总参数量为 304B,原生支持百万级 token 上下文,并带有推测解码模块。
- 要点 支持 8-bit 与 fp8 精度,基于 Transformers 架构和 Safetensors 格式,采用 MIT 开源协议。
- 要点 官方表示该版本取代了之前的预览版,尽管其激活参数远少于 V4-Pro 预览版,但大幅增强了智能体能力。
为什么重要
- 要点 根据实测者 @tomaarsen 的数据,该 304B 参数模型的性能反超了拥有 750B 参数的 GLM5.2,展现了极高的参数效率。
- 要点 这一开源举措为本地部署和开源社区开发者提供了最新工具,Hugging Face 总监 Victor Mustar 也对此次极快的上架速度表示惊叹,社区预计后续将很快跟进 GGUF 等量化格式的本地运行版本。
2026-07-31 ~ 2026-07-31 · 8 条相关
一手来源
- DeepSeek 发布 V4-Flash-0731 新模型 — deepseek-ai ·
- DeepSeek-V4-Flash 登场,304B 性能反超 750B GLM5.2 — tomaarsen ·
- DeepSeek 开源 V4 Flash 0731 模型权重 — kimmonismus ·
- 【源头】DeepSeek 发布 V4-Flash-0731 新模型 — deepseek-ai · 2026-07-31
- DeepSeek-V4-Flash-0731 模型权重正式开源发布 — shing3232 · 2026-07-31
- DeepSeek-V4-Flash 突袭上架 Hugging Face — victormustar · 2026-07-31
- 【源头】DeepSeek-V4-Flash 登场,304B 性能反超 750B GLM5.2 — tomaarsen · 2026-07-31
- 【源头】DeepSeek 开源 V4 Flash 0731 模型权重 — kimmonismus · 2026-07-31
- DeepSeek V4 Flash 权重发布,主打百万级上下文 — gaganghotra_ · 2026-07-31
- DeepSeek-V4-Flash 开源引热议:开源权重正变得极具竞争力 — eyishazyer · 2026-07-31
另有 1 条近重复转述:_akhaliq