32GB 显存跑 Qwen3.8-27B 写代码,社区征集本地模型选型经验

theexile1337 · reddit · 2026-09-08

Reddit 用户分享自己的本地 LLM 配置:32GB 显存下用 Qwen3.8-27B(Q4/Q6 量化,视上下文需求切换)写代码,偶尔用 Gemma4 31B 做研究与一般问答,以避免把隐私内容发给云端模型。

他询问是否有网站可以按用途对比本地模型,并征集其他人的本地模型、量化方案与显存搭配经验,评论区是本地部署选型的一手数据集散地。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →