omarchy-cluster 把 753B 参数 GLM-5.3 拆进四台旧 Mac 跑全量模型
natesiggard · x · 2026-10-08
开发者 Joshua Warren 发布开源项目 omarchy-cluster,演示用一台 Mac Studio、三台 MacBook Pro 和一台戴尔笔记本,通过 Omarchy(macOS/Linux)组成集群,把 GLM-5.3(753B 参数、216GB 权重)作为单一 OpenAI 兼容端点跑起来——且是全量模型,不是量化版。
- 项目基于 MLX,支持 Apple Silicon Mac、Omarchy Linux,甚至 iPhone 混组网
- 机器之间互相测量,自动决定哪个节点跑哪些层(pipeline parallelism)
- 速度很慢,但证明手头旧硬件凑一凑也能推理超大开源模型
对想把闲置 Mac 利用起来跑本地大模型的人是一套可复现的玩法。
「Infra」频道最新
- Liquid 开源 d1 决策模型,3B 玩贪吃蛇 8ms 决策碾压 OpenAI API — philipvollet · 2026-10-08
- 中国电力过剩催生数据中心,浸没冷却技术源自矿机 — teortaxesTex · 2026-10-08
- 爆料:仅一款三星 HBM 满足英伟达 Vera Rubin 性能要求 — zephyr_z9 · 2026-10-08
- Box CEO 论 agent 算力:单个应用服务 1 亿用户需 28 亿美元基建 — inductionheads · 2026-10-08
- 估值近 440 亿美元的数据中心公司 Firmus 澳交所 IPO 告急 — nordicinst · 2026-10-08
- DWDM 波长锁定精度收紧至 ±3.5GHz,OFC 后光互连规格再进化 — jwt0625 · 2026-10-08