3x 3090 本地跑 Qwen 3.8 Next Flash:3 比特量化体验堪比 Q8

nicholas_the_furious · reddit · 2026-09-20

一位本地 LLM 玩家在 3x RTX 3090(250-265W,其中一块为 TB4 eGPU)上实测 Qwen 3.8 系列模型,给出具体配置结论:

作者结论:如果你有 3x 3090,直接上 Qwen 3.8 Next Flash 的 exl3 3.05bpw;EXL3 对 27B 不划算, Unsloth Q3 量化也值得一试。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →