Apple Silicon 推理优化挑战:Gemma 4 Mac 跑速提升 151.4%
gajesh · x · 2026-09-05
YukonMLX.fast 团队公开招募 Mac 托管资源,想租 10 台 M5 Max(128GB)裸金属机器三个月,要求原生 MLX GPU 访问、sudo 权限、风扇/温度控制与响应迅速的运维支持。他们运营一个帮助开发者在 Apple Silicon 上优化推理性能的站点,宣称合作过的每个模型都拿到了 100-250% 的性能提升,并愿意给托管合作方引流作为回报。
链接中的「Gemma 4 MLX Challenge」排行榜显示:Gemma 4 26B A4B 在 Mac 上的最佳成绩比基线快 151.4%,已有 138 个入选提交、37 个求解者。评分以 prefill^0.25·decode^0.75 加权,decode 占四分之三;榜首提交(2026 年 9 月 4 日)由 Claude Opus 协助完成,Dec622.7、Pre7663.0,领先第二名仅 0.72%。头部成绩由 Claude Opus、Gemini 3.8 Flash、GPT-5.6 等模型辅助贡献。
「Infra」频道最新
- DeepSeek 拟在内蒙数据中心部署至少 16 万颗华为新一代 AI 芯片 — Polymarket · 2026-09-05
- 曝 DeepSeek 将在内蒙古新数据中心部署至少 16 万颗华为新一代 AI 芯片 — Polymarket · 2026-09-05
- 英伟达指引 FY28 营收 6910 亿美元,非超大规模云客户已占半壁江山 — Beth_Kindig · 2026-09-05
- Coatue 拟与芯片初创 MatX 设合资公司,豪掷数十亿美元买产能 — steph_palazzolo · 2026-09-05
- Mac M5 Max + Ubuntu 4090 本地跑 Opus 级编码 agent,速度近 2 倍 — julianharris · 2026-09-05
- GPU推理价值无统一度量标准,算力期货正赌在这些指数上 — AccBalanced · 2026-09-05