开源项目 MLX.fast 宣称 Apple Silicon 小模型推理最高提速 3 倍
VagabondTruffle · reddit · 2026-09-27
开发者发布开源项目 ishizuki,基于 MLX 优化 Apple Silicon 上的本地推理,宣称可让 Qwen3.8+Flash-Next 等小型模型在苹果芯片上最高提速 3 倍。作者曾在 MLX.fast 排行榜登顶,并称在 M5 以下芯片上仍是目前最优实现,欢迎社区贡献进一步优化。
「Infra」频道最新
- Polymarket 数据中心禁令预测:年内任一州出台概率仅 29% — Polymarket · 2026-09-27
- 四大科技巨头 AI 资本开支达 GDP 2.4%,已超当年电信峰值 — rickasaurus · 2026-09-27
- 高盛:token 需求 18 个月增 18 倍,仍难追平价格崩塌 — rohanpaul_ai · 2026-09-27
- 轨道算力每吉瓦成本之争:投行估 1700 亿美元,自建模型称 680 亿 — JOBhakdi · 2026-09-27
- Modal 开源 GPU Glossary:面向人类的 GPU 编程术语词典 — charles_irl · 2026-09-27
- 硬核移植:MiMo V2.6 Flash 在 4x5090+3090 Windows 集群上跑通 sglang — comperr · 2026-09-27