单张 RTX 3090 改 48GB 跑 27B Qwen 模型引围观

MaziyarPanahi · x · 2026-08-20

QuixiAI 展示了一套本地推理配置:魔改 48GB 内存的 RTX 3090,运行自家推理引擎 SlimServe 跑 UnslothAI 的 Dynamic Qwen 27B Q3KXL 量化 GGUF 模型(TurboQuant + DFlash 2)。MaziyarPanahi 随即追问该配置的实际 tokens/s 吞吐,侧面反映单卡大内存跑中等规模模型仍是本地部署圈的热门玩法。

所属事件:魔改 48GB RTX 3090 本地跑大模型引热议(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →