M2 Ultra 跑 DeepSeek V4 Flash:无损重打包至 141GiB,25.8 t/s 超 M3 Ultra

Agusx1211 · reddit · 2026-08-23

开发者针对 M2 Ultra(60 核、192GB)定制了 llama.cpp 分支,将 DeepSeek V4 Flash 无损重打包至 141 GiB,比公开 Q4 GGUF 更小(省出空间放上下文),且输出完全一致(无 KV cache 量化)。

关键成果:

代码开源:llama-cpp-ds4f-m2-ultra。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →