512GB DDR4 + 双 RTX 3090 该跑什么本地模型?

ArtifartX · reddit · 2026-09-12

Reddit 用户计划组建一台专用于本地模型推理(含 agentic coding)的服务器:512GB DDR4-2666 + 2 块 RTX 3090(48GB VRAM),未来可扩至 7 卡 PCIe 4.0 x16。求助社区:这套配置能跑什么、该跑多个小模型还是单个大模型,并引用了在双 3090 上以 9.12 tok/s 解码速度运行 Qwen 3.8-Flash-Next 的案例。讨论涉及 RAM/VRAM 配比、大模型量化的实用性与扩展规划。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →