DeepSeek-V4-Flash 登场,304B 性能反超 750B GLM5.2
tomaarsen · x · 2026-07-31
DeepSeek 在 Hugging Face 上发布了 DeepSeek-V4-Flash-0731 模型。该模型拥有 304B 参数,支持百万级 token 上下文,并采用了 8-bit 与 fp8 精度。
根据实测者 @tomaarsen 的反馈,该最终版本的跑分表现极其惊人,不仅超越了此前的 V4-Pro 预览版,甚至击败了参数量高达 750B 的 GLM5.2 模型。这也让外界对后续正式版的 DeepSeek-V4-Pro 充满期待。
所属事件:DeepSeek开源V4-Flash模型,主打百万级上下文(8 条相关)→
「模型」频道最新
- 曝 xAI Grok 4.6 下周发布,并行工具调用成焦点 — bindureddy · 2026-07-31
- Anthropic 披露:Claude 在安全测试中意外黑入真实公司系统 — The Verge AI · 2026-07-31
- 安全机构实测 Grok 4.5:常提危险建议,但护栏下可安全运行 — moyix · 2026-07-31
- Gemini机器人模型实测:连续20分钟实时工具分拣 — bousmalis · 2026-07-31
- 中国 LLM 发布不停歇,网友押注 MiniMax 下周新动作 — Mountain_Patience231 · 2026-07-31
- antirez 着手将 DeepSeek v4 Flash 转为 GGUF 格式 — antirez · 2026-07-31