RTX 6000 加载需 10 分钟?开发者排查 ComfyUI 推理瓶颈

buttplugs4life4me · reddit · 2026-08-04

一位 DevOps 工程师反馈,在使用 NVMe 和 RTX Pro 6000 显卡运行 ComfyUI 时,遇到了严重的性能瓶颈,单次生成加载时间超过 10 分钟。

排查发现,ComfyUI 似乎在将模型转移到 VRAM 之前,会先将整个模型加载到系统 RAM 中。在此过程中,CPU、存储、RAM 和 GPU 均未被充分利用。相比之下,使用 vLLM 或 llama.cpp 加载类似大小(32GB)的 LLM 模型只需 30 秒到 2 分钟。

作者吐槽 ComfyUI 的部署体验极其复杂,包含大量难以协同的 CLI 参数,且缺乏有效的调试日志。对于专业运维人员来说,这也是他们部署过的最困难的项目之一。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →