三台异构机器跑本地推理,如何统一服务与监控?

ziyaulhuk12 · reddit · 2026-10-07

Reddit 用户在 AMD(Ryzen 9 9950X + RX 7900 XTX)、NVIDIA(i5-10400 + RTX 3050)和 MacBook Pro M3 三台机器上用 LM Studio/Ollama 跑本地推理,痛点是没有统一视图:无法在一个地方看到各节点加载的模型与版本、token 吞吐、VRAM/统一内存压力等,只能逐台手动查看。他向社区求教:多节点/多 GPU 的服务与路由方案、不用逐机架 Prometheus 的可观测性方案、以及跨节点模型版本管理方法,并表示愿意分享现有配置。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →