25GB机器跑起GLM-5.2

paulabartabajo_ · x · 2026-07-13

作者称可以在一台 25GB 内存 的机器上,以“非常慢”的速度运行接近前沿的 GLM-5.2。

这条帖子的重点不是模型参数本身,而是一个有点 hacky 但很漂亮的开源贡献:它说明模型的“内存墙”并非绝对,至少在更小机器上也能把大模型跑起来。作者顺带呼吁去 GitHub 给项目点星。

所属事件:COLIBRI方案实现25GB内存跑744B大模型(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →