M1 Ultra 128GB 实测:补丁让本地 DeepSeek V4 提速至 16 tok/s

mil_phickelson · reddit · 2026-08-03

一名开发者在 M1 Ultra 128GB 设备上使用 LM Studio 本地运行 DeepSeek V4(采用 Unsloth UD-IQ3XXS 量化)。通过应用社区提供的引擎补丁,推理速度从之前的 5-6 tok/s 跃升至 15-16 tok/s,且输出质量有所改善。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →