Laguna 模型在 Mac 实现 203 TPS,联合发起 MLX 推理加速竞赛

morgymcg · x · 2026-08-07

Laguna S 2.1 模型在保持仅为 DeepSeek V4 Pro 6% 体积的同时,实现了更高的性能,并在 Mac 端达成了 203 TPS 的推理速度。

为进一步提升消费级 Mac 上的 MLX 推理效率,Laguna 团队联合 poolside.ai 发起了名为 MLX.fast 的公开竞赛,鼓励开发者协作优化推理引擎。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →