在消费级硬件上跑 744B MoE

Prompt Engineering · youtube · 2026-07-20

这是一个演示:**Colibri** 让 **GLM 5.2** 在消费级硬件上运行,作者称只需要大约 **25GB 内存**。 帖子强调了两个关键点: - 这是一个 **744B 参数的 MoE 模型** - 每个 token 实际只激活大约 **40B 参数** 由于 MoE 每一步只路由一部分专家,作者认为真正随 token 变化的权重只有约 **11GB**。这条的重点不是“模型发布”,而是说明超大模型通过路由机制和本地部署优化,可以在较普通的硬件上跑起来。

所属事件:开源Colibri让7440亿参数大模型跑在笔记本上(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →