Mac Studio 运行 Qwen 2.5 72B/27B 实测:性能与 Agent 表现
Over_Technology_1764 · reddit · 2026-08-16
一位用户在 64GB 内存的 Mac Studio 上测试了 Qwen 2.5 模型(提及 27B 和 72B,原文写法有笔误)的运行效果。使用社区 MLX 4bit 量化版本可获得约 16 tps 的速度。在尝试用 Pi Agent 制作宝可梦游戏时,模型陷入思维循环,无法推进复杂任务。作者尝试用 Hermes Agent 调优无果,最终回退到旧模型。作者征集同配置下成功运行大参数模型进行长期任务的经验。
所属事件:Mac 跑本地 Agent 模型实测:内存决定可用性(2 条相关)→
「Infra」频道最新
- Docker Model Runner 支持 CNCF ModelPack 标准 — HowDevelop · 2026-08-16
- Koboldcpp 本地推理工具发布 v1.119 版本 — Fcking_Chuck · 2026-08-16
- 光计算通用 CPU 架构:未来算力可达 Zettaflop? — jwt0625 · 2026-08-16
- 写7000行编译器将HF模型转为芯片电路 — teortaxesTex · 2026-08-16
- 数据中心建设热潮能持续25年吗? — Aurora_7021 · 2026-08-16
- 把数据中心建在月球上?让 AI 去祸害无人星球 — DevToD4 · 2026-08-16