Gemma 4 推理速度翻倍,MLX 挑战赛性能提升 130%
TheMoonMidas · x · 2026-09-02
Gemma 4 模型在 MLX 框架下的性能优化取得突破,当前解码速度达到 560 tps,预填充速度达 7k tps(8 个并发请求),相比原始基准实现了 130.7% 的性能提升。该优化工作将被整合进 @darkbloomai。
所属事件:Gemma 4 26B 在 Mac 端推理速度翻倍(3 条相关)→
「Infra」频道最新
- AMD MI355X 数周内大幅提升智能体工作流性能 — AccBalanced · 2026-09-02
- 戴尔 Q2 营收 470 亿美元创纪录,AI 服务器收入同比翻倍至 164 亿 — Beth_Kindig · 2026-09-02
- Alchemy 将内置 Cloudflare 原生 tracing,一行 Layer 即接入 — samgoodwin89 · 2026-09-02
- 华尔街错判戴尔AI服务器周期,前瞻共识严重低估 — firstadopter · 2026-09-02
- 多机分布式部署:无缝切换无需重启 — doodlestein · 2026-09-02
- Stripe Projects 上线:CLI 一键集成 Shopify,专为 AI 代理打造 — jeff_weinstein · 2026-09-02