MacBook 本地可跑 284B 参数大模型

socialwithaayan · x · 2026-08-26

开发者展示了在 MacBook 上运行大模型的最新进展:DeepSeek-V4-Flash 在 M5 Pro (20GB 内存) 上实现 5.71 tokens/sec 的解码速度,另一个 122B 模型达到 16.53 tps。这得益于名为 Palm-Infra 的技术,它能直接从 SSD 流式传输专家模型,使得 llama.cpp 无法加载的模型成为可能。项目完全开源。

所属事件:腾讯开源 Palm-Infra,MacBook 可本地跑 284B 模型(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →