开源社区一周令 M5 Ultra 的 MLX token prefill 性能翻倍
TheMoonMidas · x · 2026-09-29
开发者 viticci 实测最新 oMLX upstream 构建,发现 M5 Ultra 上的 MLX 性能在一周内大幅提升:借助 Flash-Next,token prefill 速度几乎全面翻倍。项目维护者 jundotkim 转发表示,这些进展绝大部分来自开源贡献者而非自己,并感谢对方认真做了测量。一周的改进幅度之大令实测者准备更新评测。
「Infra」频道最新
- NVIDIA 发布开源 Agent 安全平台:OpenShell 运行时边界 + BlueField-4 毫秒级隔离 — ryanshrout · 2026-09-29
- 实测 Ollama 0.40 预发布版:MLX 提速是真的,但稳定版换个 tag 就有 — TheOyinbooke · 2026-09-29
- H3 文生视频显存困境:开发者提议把 32B 文本编码器搬上云端 API — frankmanbb · 2026-09-29
- 3 万字报告:DUV 光刻机出口将左右未来十年中美 AI 芯片竞争 — fiiiiiist · 2026-09-29
- 开源 xLLM 训练框架:改数据配比不重建数据集,H200 上达 10050 tokens/s — HongyiWang10 · 2026-09-29
- AMD 市值破万亿,GPU 服务器份额仅 5%-7% 仍被低估 — Beth_Kindig · 2026-09-29