Atomic 发布 DeepSeek-V4-Flash-0731 的 GGUF 量化版
rohanpaul_ai · x · 2026-08-04
- Atomic 在 Hugging Face 上放出了 DeepSeek-V4-Flash-0731 的一组 GGUF 量化版本。
- 配图给出了不同量化档位的 体积、expert bits、PPL、Mean KLD、Top-1 match、Δp RMS 对比。
- 这些数据展示了典型权衡:量化越小,模型占用越低,但相对 BF16 基线的保真度会逐步下降。
- 这条更像是给本地部署和显存受限场景提供一份实用的模型变体参考。
所属事件:Atomic推出14款DeepSeek V4 Flash量化版(3 条相关)→
「Infra」频道最新
- 爆料称 Rubin Ultra 可能降配 HBM,性能目标不变 — AccBalanced · 2026-08-04
- Exa 称网页索引已达 800 亿页面,2027 年冲击 Google 规模 — garrytan · 2026-08-04
- OpenCode Go 单日处理 6 万亿 token,DeepSeek 占主力 — ycombinator · 2026-08-04
- QwenLM/qwen-code 0.21.5 强化 MCP 安全重放和工具追踪 — qwen-code-ci-bot · 2026-08-04
- QwenLM/qwen-code nightly 继续合入 MCP 安全与桌面迁移修复 — qwen-code-ci-bot · 2026-08-04
- 云厂商与 AI 供应商正在制造昂贵的锁定风险 — DavidLinthicum · 2026-08-04