预算 600 英镑:本地跑稠密模型买 GPU,还是靠内存跑 MoE?

Agitated_Camel1886 · reddit · 2026-07-30

一位开发者发帖求助本地推理设备的硬件选型方案,预算在 500-600 英镑,主要需求为流畅的日常对话和 RAG 任务。

目前他面临三种方案:

他向社区询问:如果选择纯 CPU 跑 MoE 模型,最低需要多少内存带宽和通道数才能保证基本的可用性?以及是否需要额外搭配一块廉价 GPU 来加速 Prompt 处理?

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →