Qwen 3.8 27B 本地部署指南:3090 上的最佳参数

cezarducatti · reddit · 2026-08-18

作者分享了在 RTX 3090 (24GB 显存) 上运行 Qwen 3.8 27B 模型的具体配置。相比 3.6 版本使用 Q4XL,作者在 3.8 版本上切换到了 Q3XL 并开启了推理模式,让其充分“思考”。实测效果出色,成功重构了超过 4000 行的 Python 脚本。配置包含 K-cache/V-cache 设置、160k 上下文窗口以及详细的启动参数。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →