M1 Ultra 128GB 实测:补丁让本地 DeepSeek V4 提速至 16 tok/s
mil_phickelson · reddit · 2026-08-03
一名开发者在 M1 Ultra 128GB 设备上使用 LM Studio 本地运行 DeepSeek V4(采用 Unsloth UD-IQ3XXS 量化)。通过应用社区提供的引擎补丁,推理速度从之前的 5-6 tok/s 跃升至 15-16 tok/s,且输出质量有所改善。
「Infra」频道最新
- 告别繁琐配置:llama.cpp官方推出Mac应用与极简部署 — rm-rf-rm · 2026-08-03
- CoreAutoAI 举办分享会:探讨打造最高度自动化的 AI 实验室 — marksaroufim · 2026-08-03
- Meta 隐秘高性能算子库 MSLK 曝光,Agent 自动生成 API 文档 — giffmana · 2026-08-03
- 苹果 512GB M3 Ultra 仍是 AI 算力孤品,AI 大神苦等 M5 Ultra — jamesdouma · 2026-08-03
- NanoGPT 训练速度创 74.6 秒新纪录,前缀 token 预测立功 — surmenok · 2026-08-03
- AI 公司盈利超预期 71%,GPU 与算力消耗证实非泡沫 — ivan_bezdomny · 2026-08-03