DeepSeek V4 Flash 本地无损运行,揭秘量化命名与精度差异

TheZachMueller · x · 2026-08-01

Unsloth AI 宣布 DeepSeek V4 Flash 0731 已支持本地运行,可在 168GB 内存上实现无损 4-bit 量化,110GB 内存上运行 3-bit 量化。

针对社区对量化命名的疑问,开发者 danielhanchen 解释称,由于 llama.cpp 缺乏原生 FP8 支持,因此采用了 Q8KXL(MXFP4+BF16,100% 无损)和 Q4KXL(MXFP4+Q80,96% 的 top-1 结果一致)等命名方式。他强调 FP8 并不等同于 Q80,认为将 FP8 视为无损是错误的。

所属事件:Unsloth发布DeepSeek V4 Flash 0731量化版,支持本地无损运行(5 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →