Unsloth 实现 DeepSeek V4-Flash 本地无损运行,最低 110GB 内存
gnukeith · x · 2026-08-01
UnslothAI 宣布支持在本地运行最新的 DeepSeek V4 Flash 0731 模型,引发开发者热烈反响。
根据其发布的指南,用户可以通过 Unsloth 或 llama.cpp 运行该模型。具体硬件需求方面,无损 4-bit 量化版本需要 168GB 内存,而 3-bit 量化版本可在 110GB 内存的设备上运行。官方表示,该版本的性能甚至超越了 V4-Pro,且更小尺寸的量化版本也将很快推出。
所属事件:DeepSeek V4 Flash量化版发布(2 条相关)→
「Infra」频道最新
- StringZilla v5 性能实测:C 标准库在 Arm 架构严重掉队 — srchvrs · 2026-08-01
- Cloudflare 预告 AI Gateway 创新周新功能 — michellechen · 2026-08-01
- DeepSeek配华为芯推理利润率超OpenAI — zephyr_z9 · 2026-08-01
- 换用 AMD RX 9070 XT 后,本地 SDXL 模型出图严重崩坏 — klobasa739 · 2026-08-01
- OmniScope: 全模态大模型无损 token 压缩框架 — Jinsen Su · 2026-08-01
- a16z:AI 算力需求激增,但供应链瓶颈拖累基础设施交付 — a16z · 2026-08-01