网友用双 RTX 5090 以 vLLM 本地部署 27B 模型

piddlefaffle12 · reddit · 2026-09-25

一位 Reddit 用户展示了在 CachyOS 系统上,用两张 RTX 5090 通过 vLLM 本地部署运行 27B 级别开源模型的截图,属于消费级双卡本地推理的实践案例,可作为端侧部署硬件配置参考。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →