硬核玩家用四根 48GB 内存折腾 GLM 模型

RedAdo2020 · reddit · 2026-08-30

一位 Reddit 用户分享了他的“怪物”级配置体验:使用四根 48GB DDR5 内存尝试运行量化后的 GLM-5.3-Flash 模型(IQ3XXS),在 Unsloth Studio 中达到了约 20 tokens/s 的生成速度。用户坦言这已不是为了性能提升,而是单纯的“因为我可以”,并吐槽了混用两套不同内存条导致的不稳定性。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →