MLX 社区把 Qwen 3.8 Flash 在 Apple Silicon 提速近 2 倍,商用部署卡在许可证
gajesh · x · 2026-09-18
- MLX.fast 社区已将 Qwen 3.8 Flash 在 Apple Silicon 上的推理速度提升近 2 倍,并计划接入 Darkbloom——一个由本地 Mac 组成的开放推理网络,让运行模型的人分享收益。
- 但社区发现该模型的许可证要求商用 serving 需另行签署协议,因此发布被暂缓。作者公开喊话 @AlibabaQwen 与 QwenDevs,希望与阿里方面直接合作推进。
「Infra」频道最新
- Google 开源 Agent Substrate:单机塞千个休眠 Agent,恢复仅 500ms — blaizedsouza · 2026-09-18
- Reddit 网友把 6 张 V100 塞进普通全塔机箱搭本地推理服务器 — Odd_Caterpillar_2994 · 2026-09-18
- Crusoe 融资 39 亿美元建 AI 数据中心,估值达 309 亿 — TechCrunch AI · 2026-09-18
- GPU 编程打卡第 257 天:推荐 2.5 小时半导体供应链入门课 — blaizedsouza · 2026-09-18
- YC F26项目Dreamscale:把机器人推理搬上云端 — ycombinator · 2026-09-18
- 社区为 Bonsai 2 27B 微调 MTP 头,推理提速约 1.25 倍 — cephaloform · 2026-09-18