700 欧元组装多卡工作站,本地跑 122B 大模型可行吗?
whatyathinkk · reddit · 2026-08-14
一位开发者发帖求助,计划以 700 欧元购入二手 Lenovo P620 工作站(搭载 Threadripper Pro 3975WX),并额外添置两张 5060Ti 显卡,用于本地部署和提供服务。
- 当前痛点:希望在无头服务器上运行 Qwen3.5 122B 模型,目前因显存和内存瓶颈容易导致系统崩溃。
- 升级方案:通过增加两张 16GB 显卡以实现双卡并发推理,但不确定是否需要等比例增加系统内存。
- 未来规划:期望未来能逐步添置更多显卡和内存,以实现本地运行更大规模的模型(如 DSv4Flash)。
跟帖讨论主要集中在多卡推理下的显存共享机制、PCIe 通道带宽瓶颈,以及 DDR4 内存速度对整体性能的影响。
「Infra」频道最新
- Hugging Face 发布 datatrove 0.10.0:支持 HF Jobs 流水线,无需 Slurm 集群 — vanstriendaniel · 2026-08-14
- Cerebras部署3T模型需68芯片与1.5MW功耗 — zephyr_z9 · 2026-08-14
- 斥资万亿美元搞基建,只为解百万奖金数学题? — suchenzang · 2026-08-14
- Intel 联手 MiniMax 发布 MXFP4 量化模型,FP4 基准测试登顶 — HaihaoShen · 2026-08-14
- GPU 价格再次暴涨:RTX 6000 Pro 跳涨至 1.5 万 — HankYeomans · 2026-08-14
- 算力并未真短缺,但租赁条款极苛刻:需签 3-5 年长约 — AccBalanced · 2026-08-14