Qwen3.8 27b 在 M5 Max 128GB 上跑分实测
julianharris · x · 2026-08-16
用户在配备 128GB 内存的 M5 Max 上测试了 Qwen 3.8 27B 模型(bf16,262k 上下文)。使用 oMLX + opencode 栈,bf16 精度下速度为 8t/s,8bit 量化下达到 17t/s。测试显示 CPU 节流明显,用户期待未来 4bit 量化和推测解码能进一步提升速度。
「Infra」频道最新
- 本地AI无需取代云模型,混合架构才是终局 — ingliguori · 2026-08-16
- 预测市场:69%概率美国某州年底前实施数据中心暂停令 — Polymarket · 2026-08-16
- AI Agent 成为隐形预算杀手,成本为何常超预期? — rvp · 2026-08-16
- 密苏里州农民主动提供土地建数据中心,此前县里叫停500英亩项目 — Polymarket · 2026-08-16
- ArchAgent v2:多级数据预取的智能体架构发现 — dair_ai · 2026-08-16
- 新开源库 LLMRouter 统一 16+ 路由实现,发布 xRouteBench 基准 — Justgototheeffinmoon · 2026-08-16