antirez 双 M5 Max 经 RDMA 跑 DeepSeek v4.1 Flash,达 25 tokens/s
antirez · x · 2026-09-11
Redis 作者 antirez 在 128GB M5 Max 上用 DwarfStar 跑 DeepSeek v4.1 Flash:单机 SSD 流式加载可达 15 tokens/s,他表示近期 SSD streaming 对保留正确专家的改进有帮助(也可能与 DS4.1 专家复用度更高有关)。进一步用两台 MacBook 各承担 50% 的张量并行、经 RDMA 互联后提升到 25 tokens/s,他认为这个场景下仍有很大优化空间,准备好后会上线发布。
所属事件:antirez 用双 MacBook 经 RDMA 本地跑 DeepSeek v4.1 Flash(3 条相关)→
「Infra」频道最新
- Claude Desktop 数据直传大厂?用 Ollama 本地模型保住隐私 — Technovangelist · 2026-09-11
- LithosAI 上线 DeepSeek-V4.1-Flash Day-0 推理,单用户 250 tokens/s — JiaZhihao · 2026-09-11
- 1 分 26 秒连续航拍 AI 视频,全流程 Mac 本地生成 — cocktailpeanut · 2026-09-11
- KV Cache 也做 QAT?技术拆解解释某模型 fp4 精度下表现更好 — stochasticchasm · 2026-09-11
- 网友猜测 Anthropic 走谷歌加部分 AWS,OpenAI 绑定微软 Azure — ericwdolan · 2026-09-11
- 英伟达:Vera Rubin 每 MW 吞吐为 Blackwell Ultra 的 50 倍,token 成本降 35 倍 — Beth_Kindig · 2026-09-11