M1 Max 性能更强:Qwen 3.8 在 128k 上下文跑出 72 tok/s
EyalToledano · x · 2026-09-02
针对 M1 Max (64GB RAM) 的测试显示,得益于更高的内存带宽(400 GB/s),性能优于 M1 Pro。在 Q4 量化、128k 上下文、100% 专家驻留内存的配置下,可实现 46 tok/s 爆发速度和 72 tok/s 的 6 Agent 聚合吞吐量。但测试也提示,在 256k 上下文下内存占用已接近极限。
「Infra」频道最新
- GLM-5.3 模型推出 GGUF 量化版,适配端侧部署 — unsloth · 2026-09-02
- Asus AI PC 价格暴涨 50%,市场预测 DGX Spark 将涨价 — mountainyoo · 2026-09-02
- 用户反馈:GPT 基础设施数月未宕机,资源限制管理出色 — natesiggard · 2026-09-02
- 微软两篇 LLM 数据库相关论文获 VLDB 2026 奖项 — jm_alexia · 2026-09-02
- 本地 RAG 应否常驻空闲算力?架构权衡讨论 — Cautious_Bit_8521 · 2026-09-02
- 英伟达财报解读播客:70%营收指引与毛利承压 — BenBajarin · 2026-09-02