Qwen3-VL 32B 无审查版发布,最低 6.7GB 显存即可跑起
Every-Walrus · reddit · 2026-08-05
开发者在 Hugging Face 上发布了 Qwen3-VL-32B-Instruct 的去审查(uncensored)量化版本 GGUF 文件。
- 极致压缩:通过移除文本编码器中未使用的部分,大幅减小了模型体积,最低仅需 6.7GB 显存即可运行。
- 配套工具:需配合作者 fork 的 ComfyUI-GGUF 加载器使用,以支持原生 ComfyUI 模型的 GGUF 量化。
所属事件:Qwen3-VL-32B 无审查量化版本发布并支持 ComfyUI(3 条相关)→
「模型」频道最新
- 字节跳动发布 SeedRealtime 全双工音视频大模型 — testingcatalog · 2026-08-05
- 别神化未发布模型,GPT Image 2已具备高质量出图能力 — Angaisb_ · 2026-08-05
- Qwen 团队 AMA 透露:3.8 版本达 2.4T 参数,即将发布 27B 新模型 — pmttyji · 2026-08-05
- ChatGPT 竟主动爆粗口,用户实测规划退休时遭意外回复 — Zikkan1 · 2026-08-05
- Qwen 团队提出 FinIndices 评测:揭示大模型金融推理存在严重瓶颈 — Qwen · 2026-08-05
- 网友吐槽 Claude Opus 回复过于直白无废话 — CtrlAltDwayne · 2026-08-05