Unsloth 实现 DeepSeek V4-Flash 本地无损运行,最低 110GB 内存

gnukeith · x · 2026-08-01

UnslothAI 宣布支持在本地运行最新的 DeepSeek V4 Flash 0731 模型,引发开发者热烈反响。

根据其发布的指南,用户可以通过 Unsloth 或 llama.cpp 运行该模型。具体硬件需求方面,无损 4-bit 量化版本需要 168GB 内存,而 3-bit 量化版本可在 110GB 内存的设备上运行。官方表示,该版本的性能甚至超越了 V4-Pro,且更小尺寸的量化版本也将很快推出。

所属事件:DeepSeek V4 Flash量化版发布(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →