花 6 万美元组 Mac 集群跑本地 LLM,性能仍不及 10 美元订阅
leebase65 · reddit · 2026-09-01
YouTube 博主 Alex Zisking 测试显示,即便使用 4 台总价 6 万美元的 Mac Studio 集群(2TB 内存)运行目前最强的开源模型 Kimi K3,开发一个简单网页仪表板仍需 4 小时,输出速度仅 17 tok/s。
相比之下,云订阅服务(如 Anthropic $20/月)仅需 15 分钟即可完成同等工作。作者认为,尽管本地 AI 理论上可行,但在普通硬件上远未达到替代云端 API 的实用水平。
「Infra」频道最新
- AWS教程:基于Bedrock构建多租户Agent聊天应用 — AWS ML Blog · 2026-09-01
- 开源 FinOps 工具 Plutus:MCP 服务器关联云账单与部署事件 — chenderson99 · 2026-09-01
- LangChain 创始人呼吁:谁来做 Agent 的开源版 Codex 浏览器? — hwchase17 · 2026-09-01
- Qwen2.5-72B 本地推理:35 tok/s vs 65 tok/s 配置解析 — LittleCelebration412 · 2026-09-01
- 质疑 NVIDIA MIG 实例上限,B300 为何仍限 7 个 — StasBekman · 2026-09-01
- 预测:69% 概率美国某州将在 2026 年前实施数据中心禁令 — Polymarket · 2026-09-01