用户对比大模型 CPU/RAM 分层加载与 MoE 跑法

Jorlen · reddit · 2026-07-29

一位 Reddit 用户在问:大家是怎么把大模型分层跑在 CPU/RAM + GPU 上的,尤其是那些 MoE 模型在很多层从显存溢到系统内存后,似乎表现不太好。

他在收集真实使用数据,重点包括:

他的目的很直接:想判断升级内存值不值,以及当前速度问题到底是软件配置还是硬件组合导致的。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →