双 RTX 3090 仍难同时装下 Qwen 图像编辑和 27B 文本模型

Civil_Fee_7862 · reddit · 2026-07-30

双 3090 仍然不够装下 Qwen Image Edit

这条帖在问:如何在不加硬件的情况下,把图像生成任务也塞进一套双 RTX 3090 的 AI PC 里,同时还要运行一个 4-bit 的 Qwen3.6-27B 文本模型(8-bit KV cache)。

已尝试的方案

当前结论

作者最终在考虑再买一张 RTX 3090 专门跑图像生成,因为即使 4-bit 的 Qwen Image Edit 勉强塞进约 14GB,8-bit 版本大概率也放不下。他想确认是否有人做过类似的多 GPU 分工方案,以及有没有 PyTorch 参数能让类似 Stable Diffusion 的模型在 tensor parallelism / pipeline parallelism 下稳定工作。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →